课程 348 / 365
95%
正文已完成
L348能稳定交付的任务才算能力
用任务、难度、独立程度和证据替代课程数量与工具清单,建立能力盘点直觉。
“会Prompt”“懂Agent”很难被别人验证。能力要落到真实任务上,写清任务难度、独立程度和交付质量,并附上证据和仍需帮助的情况。
能把一个模糊能力标签改写成可观察、可验证的任务表现。
核心概念
先把关键判断说清楚
任务定义能力
“能把30条投诉归类并引用证据”比“擅长AI分析”更具体。
独立程度揭示熟练度
照教程完成、在提示下完成、独立完成和能指导他人,是不同能力层级。
边界让能力可信
说明尚不适用的场景和失败样本,往往比全能描述更能建立信任。
案例拆解
把“熟练使用AI”改成可验证能力
学习者简历只写“熟练使用多种AI工具”,面试官无法判断实际工作价值。
- 01
选取真实任务是把会议逐字稿整理成决策、负责人和日期。
- 02
说明独立程度是能自行设计Schema、处理缺失并核对原句。
- 03
附上脱敏前后样例、错误清单和复盘,同时说明高风险承诺需负责人确认。
案例结果
能力描述从工具熟悉度变成可检查的工作交付。
提交前练习
现在轮到你
把一个“我会……”的能力标签改写成证据型描述。
内容会自动保存在当前设备
查看参考答案与评分标准
参考答案
能力是独立把100条客服对话归为5类,输出原句证据与JSON;证据是标注集上关键类别召回96%、格式100%通过;边界是政策归因由客服主管确认,不处理未脱敏数据。
评分标准
- 任务有明确输入输出
- 独立程度不过度夸大
- 证据和边界都可复查
本课收口 · 学习证据
完成,不等于随手打一个勾。
确认阅读、保存练习,再用 30 秒检查和一句话总结留下真实学习证据。
02完成本课练习0 / 4 项必填内容已填写
03通过理解检查约 30 秒
你现在更接近哪一种状态?
完成上面三项后,才能把本课记为已验证。
资料来源
继续核对与延伸阅读
本课内容最近更新于 。
- Evals↗official-docs · 核对日期 2026-08-23
- NIST AI Risk Management Framework↗standard · 核对日期 2026-08-23