课程 322 / 365
88%
正文已完成
L322合并时保留来源链与不确定性
判断证据质量、时间差、口径差和推断,避免把汇总写成虚假共识。
多个输出都写了同一结论,不代表结论更真;它们可能复制同一二手来源。合并需要检查来源独立性、核对日期和测量口径,并把汇总者推断明确标注。
能在结果合并中区分已证实事实、来源分歧与汇总者推断。
核心概念
先把关键判断说清楚
来源数量不等于独立性
三篇文章都引用同一公告,本质仍只有一个原始来源,不能当作三重验证。
时间与口径决定可比性
不同版本、地区、样本和统计周期的数据不能直接平均或投票。
推断要与事实分层
从多项证据得出的判断应标“推断”并说明依据,避免被读者误认为来源原文。
案例拆解
三个价格结论其实来自不同套餐
研究分支分别报告某工具月价 20、25、30 美元,汇总者准备取平均值。
- 01
核对每条来源的日期、地区、币种、计费周期和套餐。
- 02
发现20为年付折算、25为月付、30含团队功能,三者口径不同。
- 03
分别保留三种价格条件,不做平均,并标注当前官方页面核对日期。
案例结果
汇总结果诚实呈现条件差异,而不是制造一个不存在的“平均价格”。
提交前练习
现在轮到你
合并三条看似同主题的证据,标出可比性和推断边界。
内容会自动保存在当前设备
查看参考答案与评分标准
参考答案
三条模型性能数据中两条转引同一论文,去重为一个来源;第三条使用不同硬件和量化,不能直接平均。推断是量化可能降低内存,但速度差异无法从现有口径确认,信心低。
评分标准
- 转引没有被当作独立证据
- 不可比条件被明确指出
- 推断与来源事实分开
本课收口 · 学习证据
完成,不等于随手打一个勾。
确认阅读、保存练习,再用 30 秒检查和一句话总结留下真实学习证据。
02完成本课练习0 / 4 项必填内容已填写
03通过理解检查约 30 秒
你现在更接近哪一种状态?
完成上面三项后,才能把本课记为已验证。
资料来源
继续核对与延伸阅读
本课内容最近更新于 。
- Evals↗official-docs · 核对日期 2026-08-23
- NIST AI Risk Management Framework↗standard · 核对日期 2026-08-23
- Trustworthy agents in practice↗paper · 核对日期 2026-08-23