【发布时间】:2019-07-16 01:36:11
【问题描述】:
我有一个最多有 75 个节点的 kops 集群,并添加了cluster autoscaler。它使用kubenet 网络。 事情目前已经停止工作 - 即不再发生缩减。
集群以最大容量运行,即 75 个节点,即使几乎没有负载。不知道从哪里着手解决问题。
在集群自动扩缩器 pod 中查看以下错误
I0222 01:45:14.327164 1 static_autoscaler.go:97] Starting main loop
W0222 01:45:14.770818 1 static_autoscaler.go:150] Cluster is not ready for autoscaling
I0222 01:45:15.043126 1 leaderelection.go:199] successfully renewed lease kube-system/cluster-autoscaler
I0222 01:45:17.121507 1 leaderelection.go:199] successfully renewed lease kube-system/cluster-autoscaler
I0222 01:45:19.126665 1 leaderelection.go:199] successfully renewed lease kube-system/cluster-autoscaler
I0222 01:45:21.327581 1 leaderelection.go:199] successfully renewed lease kube-system/cluster-autoscaler
I0222 01:45:23.331802 1 leaderelection.go:199] successfully renewed lease kube-system/cluster-autoscaler
I0222 01:45:24.775124 1 static_autoscaler.go:97] Starting main loop
W0222 01:45:25.085442 1 static_autoscaler.go:150] Cluster is not ready for autoscaling
自动缩放工作正常。
更新,运行kops validate cluster时也看到如下错误
VALIDATION ERRORS
KIND NAME MESSAGE
Node ip-172-20-32-173.ec2.internal node "ip-172-20-32-173.ec2.internal" is not ready
...
I0221 22:16:02.688911 2403 node_conditions.go:60] node "ip-172-20-51-238.ec2.internal" not ready: &NodeCondition{Type:NetworkUnavailable,Status:True,LastHeartbeatTime:2019-02-21 22:15:56 -0500 EST,LastTransitionTime:2019-02-21 22:15:56 -0500 EST,Reason:NoRouteCreated,Message:RouteController failed to create a route,}
【问题讨论】:
-
你能从集群自动缩放器中为
cannot be removedgrep 日志吗?分配的资源如何查看节点?
标签: kubernetes autoscaling kops