【发布时间】:2017-11-14 06:00:42
【问题描述】:
我对我认为是自动缩放器的 k8s 有疑问。
自动扩缩器在最近一次部署后启动了一个新集群(我可以在我们的 k8s 部署托管的 EC2 上看到该实例),但是当我执行 kubectl get nodes 时它没有显示。
kubectl get nodes
NAME STATUS ROLES AGE VERSION
ip-172-20-110-212.ec2.internal Ready master 322d v1.5.1
ip-172-20-129-59.ec2.internal Ready master 322d v1.5.1
ip-172-20-153-170.ec2.internal Ready <none> 322d v1.5.1
ip-172-20-160-119.ec2.internal Ready master 322d v1.5.1
ip-172-20-162-94.ec2.internal Ready <none> 316d v1.5.1
ip-172-20-166-194.ec2.internal Ready <none> 322d v1.5.1
ip-172-20-79-1.ec2.internal Ready <none> 112d v1.5.1
ip-172-20-92-163.ec2.internal Ready <none> 322d v1.5.1
此外,与这个“缺失”节点的 IP 匹配的 kube-proxy pod 确实会出现,但每 30 秒就会被杀死并重新启动。
kubectl get pods
kube-proxy-ip-172-20-181-122.ec2.internal 1/1 Running 0 17s
【问题讨论】:
-
最好分享有关每 30 秒重新启动的节点的更多详细信息。可能是
k describe node <nodename>- 如果没有这些数据,几乎不可能最终确定可能出了什么问题! -
重新启动的不是节点,而是 pod。 kubectl get 节点中缺少的节点全部在一起。有问题的 pod 上的 describe pod 不会产生任何有趣的信息,并且在它被杀死之前没有记录事件。
标签: amazon-ec2 kubernetes