【发布时间】:2020-02-14 13:48:04
【问题描述】:
我目前正在开发一项监控服务,该服务将监控 Kubernetes 的部署及其 pod。我想在部署未运行预期数量的副本以及 pod 的容器意外重启时通知用户。这可能不是要监控的正确事情,我非常感谢一些关于我应该监控的内容的反馈。
无论如何,主要的问题是豆荚的所有状态之间的差异。当我说 Statuses 时,我指的是运行 kubectl get pods 时的 Status 列。有问题的状态是:
- ContainerCreating
- ImagePullBackOff
- Pending
- CrashLoopBackOff
- Error
- Running
是什么导致 pod/容器进入这些状态?
对于前四个状态,这些状态是否可以在没有用户交互的情况下恢复? CrashLoopBackOff 的阈值是多少? Running 是唯一具有 Ready Condition 为 True 的状态吗?
任何反馈将不胜感激!
此外,在自动化脚本中使用kubectl 进行监控会是不好的做法吗?比如每分钟将kubectl get pods的结果记录到Elasticsearch?
【问题讨论】:
标签: kubernetes kubectl