【问题标题】:Why are new node instances not available after Increasing GKE Cluster's Node Pool size?为什么增加 GKE 集群的节点池大小后新节点实例不可用?
【发布时间】:2022-01-04 23:51:30
【问题描述】:

我对 K8 比较陌生,我已经在 GKE 上设置了一个带有单个节点池的私有集群。节点池配置为在单个 GCP 区域中的 3 个区域上具有节点(启用自动缩放,最少 2 个节点,最多 20 个节点)。

我在尝试部署新资源时遇到了以下错误:Cannot schedule pods: Insufficient memory. 我决定在集群的节点池上禁用自动缩放,然后手动增加节点数。我应用了更改,每个实例组现在有 3 个实例(总共 9 个)。但是,GKE 控制台的“节点”部分下列出的实例并未反映这一点。它只显示 5 个(实际上比原来的 6 个减少了)。

GCP 文档: https://cloud.google.com/kubernetes-engine/docs/how-to/resizing-a-cluster

我在这里缺少什么?谢谢

【问题讨论】:

  • 调整大小后日志显示什么?
  • 我过去也遇到过类似的问题。是版本不匹配造成的,nodepool GKE版本低于集群GKE版本。
  • 看起来您的资源请求/限制配置错误。您的 5 个工人中有 4 个几乎处于65%+ CPU 请求,并且,1 个工人处于unknown 状态。我建议从您尝试部署的任何资源中删除任何资源限制/请求。
  • @Hitobat 你是对的,这是集群和节点池版本不匹配的问题。
  • @hdhruna 您能否详细说明您对资源请求/限制的评论?这对这个问题有什么影响?

标签: kubernetes google-cloud-platform google-kubernetes-engine


【解决方案1】:

这里的问题是集群和节点池的版本不匹配造成的。

默认情况下,automatic upgrades 已为 Google Kubernetes Engine (GKE) 集群和节点池启用。

Here 是帮助手动升级集群或节点池的文档。


可以通过运行以下命令升级到默认集群版本:

gcloud container clusters upgrade CLUSTER_NAME --master

可以通过运行以下命令将所有节点更新到与控制平面相同的版本:

gcloud container clusters upgrade

在回滚升级时应使用以下命令:

gcloud container node-pools rollback NODE_POOL_NAME \  --cluster CLUSTER_NAME

另请参阅 this referencethis documentation

【讨论】:

    猜你喜欢
    • 2017-04-16
    • 2021-06-10
    • 2019-06-23
    • 2017-09-28
    • 2017-11-02
    • 1970-01-01
    • 2021-11-22
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多