课程 352 / 365
96%
正文已完成
L352作品范围要小到能验证,大到能体现判断
比较数据、功能、风险、时间和演示路径,识别过大与过小的选题。
“全自动企业助手”无法在短周期内诚实验证,“只做一个按钮”又难以展示完整思考。合适范围通常包含一条端到端用户路径、一个核心难点、明确边界和足够样本。
能把一个过宽作品缩成四周内可交付、能体现关键能力的最小版本。
核心概念
先把关键判断说清楚
端到端优于功能碎片
从输入到结果,再到错误处理与复盘,形成完整流程,比十个互不连接的Demo功能更有说服力。
只保留一个核心不确定性
作品可以重点验证检索、评测或交互之一,其余采用简单可靠方案。
高风险能力先缩权限
支付、医疗、法律和外部发布应从建议、草稿或只读开始,避免作品无法安全演示。
案例拆解
把全能Agent缩成只读核验助手
原作品计划读取邮件、修改日程、发送回复和付款,四周内无法验证权限与恢复。
- 01
冻结核心问题为“从指定邮件中提取待办并引用原句”。
- 02
只读访问导出的脱敏邮件,不连接真实账户和外部发送。
- 03
加入人工确认、错误样本和评测,让作品展示证据链与权限判断。
案例结果
范围缩小后仍能体现Agent设计、安全边界和评测能力,并可在四周完成。
提交前练习
现在轮到你
把一个过宽作品缩成四周最小可验证版本。
内容会自动保存在当前设备
查看参考答案与评分标准
参考答案
路径是上传政策PDF→提问→返回带页码引用;核心难点是检索引用;不做多用户、自动改文档和公开发布;第1周样本、第2周检索、第3周界面与错误、第4周评测与案例。
评分标准
- 范围形成完整单路径
- 明确一个核心不确定性
- 每周都能产生可验收产物
本课收口 · 学习证据
完成,不等于随手打一个勾。
确认阅读、保存练习,再用 30 秒检查和一句话总结留下真实学习证据。
02完成本课练习0 / 4 项必填内容已填写
03通过理解检查约 30 秒
你现在更接近哪一种状态?
完成上面三项后,才能把本课记为已验证。
资料来源
继续核对与延伸阅读
本课内容最近更新于 。
- Building Effective Agents↗guide · 核对日期 2026-08-23
- NIST AI Risk Management Framework↗standard · 核对日期 2026-08-23
- Evals↗official-docs · 核对日期 2026-08-23