Kubernetes 可观测性的“三大支柱”是什么?Prometheus 主要负责哪一块?
2026-08-11 01:06:54 # 监控

“可观测性(Observability)”是这两年运维圈的高频词,而它的落地通常围绕三个核心信号展开,业内称之为**“三大支柱”**:指标(Metrics)、日志(Logs)和链路追踪(Traces)。

三大支柱分别回答什么问题

支柱 通常使用的工具 回答的问题 例子
指标 Metrics Prometheus 系统发生了什么,程度如何 CPU 使用率达到 85%
日志 Logs Loki / EFK(Elasticsearch+Fluentd+Kibana) 具体发生了什么事件 报错“connection refused”
链路追踪 Traces Jaeger / Tempo 哪里是性能瓶颈 定位到是 API 调用数据库的延迟过高

Prometheus 主要负责哪一块

Prometheus 主要负责 Metrics(指标)这一块。

它擅长回答“系统现在是什么状态、严重到什么程度”这类聚合性问题,比如“过去 5 分钟的错误率是多少”、“某个 Pod 的内存是否即将触顶”。

而具体的错误细节要去看 Logs,端到端的性能瓶颈则要靠 Traces。三者互补而非替代——一个健壮的运维体系,往往是“指标发现问题 → 日志定位原因 → 链路追踪定位慢点”的闭环。