TATECHATLAS
◎ 简体中文
TECHNOLOGY / KNOWLEDGE / PRACTICE

AI、编程、SQL、Web 和 SAP:指南与建议

人工智能、Python、Git、SQL、Web/API、SAP/ERP、统计与时间序列内容:原理说明、示例、实用建议、参考来源及适用范围。

最新指南

1-24 / 51 篇内容

选择二元分类评估指标以降低假阳性

本指南介绍如何在 scikit-learn 中选择以精确度为导向的指标、进行阈值分析以及分解混淆矩阵,从而在二元分类任务中最大限度地减少假阳性率。

binary-classification / precision / false-positive / scikit-learn / threshold-selection / confusion-matrix / det-curve / model-evaluation

在 PostgreSQL 中使用 LIMIT 和 OFFSET:最佳实践、性能影响及替代方案

本指南详细解释了 PostgreSQL 中 LIMIT 和 OFFSET 的工作原理及其在分页数据检索中的用例。文章深入探讨了为何较大的 OFFSET 值会导致严重的性能问题,并说明了何时应切换到基于游标的分页方法。内容包含语法示例、ORDER BY 子句的强制要求、常见陷阱以及符合 PostgreSQL 和 GitHub REST API 标准的替代方法。通过对比分析,帮助开发者理解不同分页策略的优劣,确保数据库查询的高效性和结果的一致性。

PostgreSQL / database pagination / LIMIT / OFFSET / cursor-based pagination / query performance

SAP S/4HANA 中的分段报表:业务单位平衡

本文介绍如何在 SAP S/4HANA 中配置文档拆分,以启用多个业务单位的平衡表,利用通用日记账。这消除了财务会计和管理会计之间的调整需求,并提供了详细的业务绩效见解。我们详细介绍了关键组织元素 - 会计科目表和台账单位,以及它们如何与分段报表交互。

SAP S/4HANA / Universal Journal / Segment Reporting / Financial Accounting / Controlling / Document Splitting / Balance Sheets / Reporting

AI 精确率和召回率在小数据集上的评估

了解如何在 AI 模型的小型问题数据集上有效评估精确率和召回率。本指南使用 scikit-learn 涵盖了概念、计算方法和实际注意事项。

ai / precision / recall / evaluation / small dataset / machine learning / scikit-learn / classification

选择 MAE 还是 RMSE 进行误差预测

了解平均绝对误差 (MAE) 和均方根误差 (RMSE) 之间的区别,如何为您的预测任务选择正确的指标,以及大误差对每个指标的影响。

regression / model evaluation / MAE / RMSE / error metrics / scikit-learn / machine learning

PostgreSQL INSERT ... ON CONFLICT:精准实现唯一约束下的插入与更新

PostgreSQL 的 INSERT ... ON CONFLICT 语句提供原子化的 upsert 操作,支持根据唯一约束或索引自动处理冲突。通过 DO NOTHING 或 DO UPDATE 选择是忽略冲突或更新现有行,并利用 EXCLUDED 伪表获取待插入值。但单行原子性不保证业务级别的幂等性或并发安全,需手动处理重复键和并发索引维护问题。

postgresql / sql / upsert / insert / on-conflict / unique-constraint / concurrency / database

使用经验覆盖率和宽度评估预测区间

预测区间旨在包含未来单个观测值,而置信区间针对均值或其他参数,两者不可互换。经验覆盖率是保留数据中落在区间内的比例,宽度是分位数界限之间的距离;一个构造的五值示例给出 80% 覆盖率和平均宽度 1.8。

prediction interval / confidence interval / quantile regression / empirical coverage / interval width / scikit-learn / calibration / held-out evaluation
编程指南

使用显式Python合约在JSON中序列化datetime和Decimal

使用ISO时间戳字符串和十进制字符串,然后显式重建字段。一个完整的标准库示例显示了时区检查、精度和可预测的失败。

JSON / Serialization / Deserialization / Datetime / Decimal / Python / Data Contract / Type Handling
编程指南

使用 pathlib 实现 Python 跨平台安全路径处理

本指南介绍如何使用 pathlib 进行文件存在性检查、扩展名修改、目录遍历和路径解析,避免在 Windows 或 Unix 系统上引入特定平台的错误。

pathlib / cross-platform / python / file-system / os.PathLike / PurePath / glob / resolve

选择 RAG 分块边界和重叠以保留节上下文

本文解释了如何在检索增强生成(RAG)系统中选择有效的分块边界和重叠,比较了固定大小和文档感知策略。使用假设的支持说明示例,它演示了跨语义单元分割的风险,并展示了元数据和重叠如何保留上下文。该指南基于 Microsoft Azure 关于向量搜索和 RAG 工作流中分块的文档。

RAG / chunking / Azure AI Search / information retrieval / document processing

验证 RAG 引用:从来源存在到主张支持的深度解析

引用标识符仅证明来源已被检索,而非证明其支持特定主张。本文通过假设的政策示例,详细介绍了如何将答案分解为原子主张、定位支持段落,以及如何将检索检查与 groundedness(基于事实的可靠性)检查区分开来,以确保 RAG 系统的输出真实可靠。

RAG / citation verification / groundedness / retrieval evaluation / prompt engineering / LLM evaluation