【发布时间】:2020-04-17 03:50:51
【问题描述】:
您遇到的问题:
"runtime network not ready: NetworkReady=false reason:NetworkPluginNotReady message:docker: network plugin is not ready: cni config uninitialized"
你预期会发生什么:
- 升级应该可以工作
- 回滚应该可以工作
- 将其大小重新调整为 2,所有服务都应启动
重现步骤:
Running GKE
Master version 1.14.8-gke.12
Node version: 1.14.8-gke.2
Machine type n1-standard-8
然后在此升级问题之前完美运行:
1)
gcloud beta container node-pools update k-cpu-pool-v1 --cluster=k --workload-metadata-from-node=GKE_METADATA_SERVER --zone=us-central1-a
# fails with 2nd node
gcloud beta container node-pools rollback k-cpu-pool-v1 --cluster=k3 --zone=us-central1-a
# also fails with 2nd node and many deployment won't come up
2)
trying to "Enable metadata server" per instruction
https://medium.com/@louisvernon/mapping-kubernetes-service-accounts-to-gcp-iams-using-workload-identity-b53496d543e0
but blocked by failure of previous deployment
其他信息(您尝试过的解决方法、查阅的文档等):
I tried looking at google forum issue but nothing. Looks like a GKE issue with
rollback when upgrade fails. double issue. Upgrade and master and node to have
same version?
It doesn't seem to be this issue because one node came up but second does not in GKE.. (https://stackoverflow.com/questions/52675934/network-plugin-is-not-ready-cni-config-uninitialized)
【问题讨论】:
-
您能否提供您在每一步中遇到的命令和错误的全文?您是否在集群级别启用了 Workload Identity?
-
从 step1 运行上述命令没有错误。该节点具有较旧的 GKE_METADATA_SERVER 1.14.8-gke.2 但在“gcloud beta 容器节点”的条件下仍因“运行时网络未准备好:NetworkReady=false 原因:NetworkPluginNotReady 消息:docker:网络插件未准备好:cni 配置未初始化”而失败-pools update k-cpu-pool-v1 --cluster=k --workload-metadata-from-node=GKE_METADATA_SERVER --zone=us-central1-a"
-
不幸的是,目前还不清楚发生了什么以及为什么。请编辑您的问题并提供有关您的步骤、决定和命令/错误的全文的更多详细信息。顺便说一句,您正在使用 BETA 函数“Workload Identity”和“gcloud beta”命令——它们不如稳定的命令稳定,我不想在生产中使用它们。
-
是的。它是 beta 命令,目标是修复尝试访问 GCP 存储桶的 403 错误。现在,当自动缩放到多个节点并且 kubeflow 的部署被阻止时,我的 cni 网络出现错误。第 1 步是将 GKE_METADATA_SERVER 更新为每篇媒体文章的更新代码,以使用不同的运行服务帐户而不是默认服务帐户来访问存储桶。第 2 步是通过回滚从第 1 步恢复。
-
您似乎报告了一个错误。我建议你在谷歌问题跟踪器上发布这个
标签: google-kubernetes-engine rollback