课程 303 / 365
83%
部署与可靠性·理解·10 分钟
正文已完成

指标、日志与追踪回答不同问题

从聚合趋势、离散事件与跨服务路径理解三类可观测信号的职责。

L303

可观测性不是“多打日志”。指标适合发现趋势与告警,日志保存带上下文的离散事件,追踪展示一次请求跨组件的完整路径。三者用一致的请求 ID 和服务字段关联,才能从异常数字走到具体证据。

这一课的结果

能为一个故障问题选择指标、日志或追踪,并说明三者怎样关联。

核心概念

先把关键判断说清楚

01

指标看整体变化

请求率、错误率、延迟分位数和资源饱和度适合低成本持续聚合。

02

日志解释具体事件

结构化日志记录错误码、业务状态和非敏感上下文,支持定位一类或一次失败。

03

追踪连接因果路径

Trace 与 span 显示请求经过哪些服务、各段耗时和失败位置,适合分布式调用。

案例拆解

从延迟告警走到慢数据库查询

课程页 p95 延迟告警触发,但单看应用日志只见“请求完成”。

  1. 01

    指标确认延迟仅发生在课程详情入口,开始时间为14时05分。

  2. 02

    追踪显示数据库 span 占 92% 时间,并关联 trace_id。

  3. 03

    按 trace_id 查结构化日志,发现特定查询缺少索引且输入规模异常。

案例结果

三类信号从“哪里慢”逐层收敛到具体查询与输入。

提交前练习

现在轮到你

为一个关键请求设计最小三信号组合。

内容会自动保存在当前设备
查看参考答案与评分标准

参考答案

请求是生成课程摘要;指标是请求数、错误率、p95、模型并发;日志是lesson_id、模型、错误码,不记正文;追踪是入口、资料加载、模型调用、存储;用 trace_id 与 request_id 关联。

评分标准

  • 每类信号回答不同问题
  • 日志字段不泄露敏感内容
  • 关联键贯穿完整请求

本课收口 · 学习证据

完成,不等于随手打一个勾。

确认阅读、保存练习,再用 30 秒检查和一句话总结留下真实学习证据。

0 / 3
02完成本课练习0 / 4 项必填内容已填写
03通过理解检查约 30 秒
要判断一次请求在哪个下游服务耗时最多,最直接依赖哪类信号?
你现在更接近哪一种状态?
完成上面三项后,才能把本课记为已验证。

资料来源

继续核对与延伸阅读

本课内容最近更新于