Kubernetes 可观测性的“三大支柱”是什么?Prometheus 主要负责哪一块?
2026-08-11 01:06:54
# 监控
“可观测性(Observability)”是这两年运维圈的高频词,而它的落地通常围绕三个核心信号展开,业内称之为**“三大支柱”**:指标(Metrics)、日志(Logs)和链路追踪(Traces)。
三大支柱分别回答什么问题
| 支柱 | 通常使用的工具 | 回答的问题 | 例子 |
|---|---|---|---|
| 指标 Metrics | Prometheus | 系统发生了什么,程度如何 | CPU 使用率达到 85% |
| 日志 Logs | Loki / EFK(Elasticsearch+Fluentd+Kibana) | 具体发生了什么事件 | 报错“connection refused” |
| 链路追踪 Traces | Jaeger / Tempo | 哪里是性能瓶颈 | 定位到是 API 调用数据库的延迟过高 |
Prometheus 主要负责哪一块
Prometheus 主要负责 Metrics(指标)这一块。
它擅长回答“系统现在是什么状态、严重到什么程度”这类聚合性问题,比如“过去 5 分钟的错误率是多少”、“某个 Pod 的内存是否即将触顶”。
而具体的错误细节要去看 Logs,端到端的性能瓶颈则要靠 Traces。三者互补而非替代——一个健壮的运维体系,往往是“指标发现问题 → 日志定位原因 → 链路追踪定位慢点”的闭环。