【发布时间】:2021-10-11 10:56:03
【问题描述】:
我已经阅读了一堆指南,展示了如何使用 Prometheus 监控 Kubernetes 中 pod 的 cpu 和内存使用情况,其中大多数看起来像这样:
rate(container_cpu_usage_seconds_total{pod=~"compute-.*", image!="", container!="POD"}[5m])
但我找不到任何关于容器标签为何存在的文档(似乎它会导致重复数据)以及为什么在许多监控示例中都避免使用它。 我知道这个指标来自 Kubernetes 的 cadvisor 组件,但我能找到的关于这些指标的唯一文档是代码 here 中提供的简短描述。
有谁知道这个标签是干什么用的,哪里有没有这些指标的更深入的文档?
【问题讨论】:
-
您能否提供有关指南的其他信息,您在哪里找到了这些信息? - 链接、屏幕截图……这将有助于更好地理解问题。
-
就是here描述的“暂停容器”。
标签: kubernetes prometheus grafana