课程 303 / 365
83%
正文已完成
L303指标、日志与追踪回答不同问题
从聚合趋势、离散事件与跨服务路径理解三类可观测信号的职责。
可观测性不是“多打日志”。指标适合发现趋势与告警,日志保存带上下文的离散事件,追踪展示一次请求跨组件的完整路径。三者用一致的请求 ID 和服务字段关联,才能从异常数字走到具体证据。
能为一个故障问题选择指标、日志或追踪,并说明三者怎样关联。
核心概念
先把关键判断说清楚
指标看整体变化
请求率、错误率、延迟分位数和资源饱和度适合低成本持续聚合。
日志解释具体事件
结构化日志记录错误码、业务状态和非敏感上下文,支持定位一类或一次失败。
追踪连接因果路径
Trace 与 span 显示请求经过哪些服务、各段耗时和失败位置,适合分布式调用。
案例拆解
从延迟告警走到慢数据库查询
课程页 p95 延迟告警触发,但单看应用日志只见“请求完成”。
- 01
指标确认延迟仅发生在课程详情入口,开始时间为14时05分。
- 02
追踪显示数据库 span 占 92% 时间,并关联 trace_id。
- 03
按 trace_id 查结构化日志,发现特定查询缺少索引且输入规模异常。
案例结果
三类信号从“哪里慢”逐层收敛到具体查询与输入。
提交前练习
现在轮到你
为一个关键请求设计最小三信号组合。
内容会自动保存在当前设备
查看参考答案与评分标准
参考答案
请求是生成课程摘要;指标是请求数、错误率、p95、模型并发;日志是lesson_id、模型、错误码,不记正文;追踪是入口、资料加载、模型调用、存储;用 trace_id 与 request_id 关联。
评分标准
- 每类信号回答不同问题
- 日志字段不泄露敏感内容
- 关联键贯穿完整请求
本课收口 · 学习证据
完成,不等于随手打一个勾。
确认阅读、保存练习,再用 30 秒检查和一句话总结留下真实学习证据。
02完成本课练习0 / 4 项必填内容已填写
03通过理解检查约 30 秒
你现在更接近哪一种状态?
完成上面三项后,才能把本课记为已验证。
资料来源
继续核对与延伸阅读
本课内容最近更新于 。
- OpenTelemetry Signals↗official-docs · 核对日期 2026-08-23
- Monitoring Distributed Systems↗reference · 核对日期 2026-08-23