课程 355 / 365
97%
正文已完成
L355证据必须可追溯、可复现且不过度包装
判断截图、日志、提交、指标和用户反馈的真实性边界与脱敏要求。
证据不是越多越可信。没有日期和环境的数字无法比较,裁剪过度的截图可能隐藏失败,把团队结果写成个人贡献也会误导。每条证据应绑定主张、来源、时间、范围和隐私处理。
能审查一条作品证据是否支持对应主张,并指出缺失条件。
核心概念
先把关键判断说清楚
主张与证据一一对应
性能数字支持速度主张,用户反馈支持可用性主张,不能用界面截图证明准确率。
上下文防止误读
指标要注明数据集、样本量、版本、设备和测量方法,避免脱离条件传播。
脱敏不等于删除关键事实
隐去姓名和原文敏感段,同时保留数据类型、规模、方法和可验证摘要。
案例拆解
“准确率98%”为何暂不可用
作品页写准确率98%,但没有样本来源、数量、类别分布和评分方式。
- 01
追溯到20条由作者自己挑选的简单样本,发现不能代表真实数据。
- 02
重新冻结200条分层脱敏样本,由同伴复核标签。
- 03
报告总体与关键类别指标、模型版本、失败例,并把原98%标为早期探索。
案例结果
数字获得明确条件,旧指标没有被悄悄删除或继续冒充正式结果。
提交前练习
现在轮到你
审查三条作品主张及其证据,判断是否足够。
内容会自动保存在当前设备
查看参考答案与评分标准
参考答案
主张“节省50%时间”;现证据仅一次自测;需记录旧流程、10次同类任务、人工复核时间和版本;补证为同一人员交叉试验,报告中位数与失败范围。
评分标准
- 证据类型能支持主张
- 上下文足以防止外推
- 补证兼顾隐私与复现
本课收口 · 学习证据
完成,不等于随手打一个勾。
确认阅读、保存练习,再用 30 秒检查和一句话总结留下真实学习证据。
02完成本课练习0 / 4 项必填内容已填写
03通过理解检查约 30 秒
你现在更接近哪一种状态?
完成上面三项后,才能把本课记为已验证。
资料来源
继续核对与延伸阅读
本课内容最近更新于 。
- Evals↗official-docs · 核对日期 2026-08-23
- NIST AI Risk Management Framework↗standard · 核对日期 2026-08-23
- Pro Git↗reference · 核对日期 2026-08-23