【发布时间】:2023-04-04 08:15:01
【问题描述】:
我已经开始测试 Google Cloud 的 Kubernetes Engine 新 Autopilot 功能,但我在自动扩缩后端遇到了很多问题。
我有一个相当标准的集群配置,基本上选择了所有默认值。我正在尝试部署多个由单个 nginx 入口支持的微服务来管理流量。
我看到的是计算资源根本没有扩大,而且我在配置中没有看到任何表明这是为什么的东西。
如果我查看集群日志,我会看到解释为什么没有发生扩展的结果,但我无法解释它报告的问题或如何解决这些问题。
例如:
{
"noDecisionStatus": {
"measureTime": "1623700519",
"noScaleUp": {
"unhandledPodGroupsTotalCount": 1,
"unhandledPodGroups": [
{
"podGroup": {
"totalPodCount": 1,
"samplePod": {
"name": "proxy-9d779889d-zt8pv",
"namespace": "default",
"controller": {
"kind": "ReplicaSet",
"apiVersion": "apps/v1",
"name": "proxy-9d779889d"
}
}
},
"napFailureReasons": [
{
"messageId": "no.scale.up.nap.pod.zonal.resources.exceeded",
"parameters": [
"northamerica-northeast1-c"
]
}
]
}
],
...
no.scale.up.nap.pod.zonal.resources.exceeded
这似乎表明我不允许将此单区域集群扩展到当前位置之外。但我看不到任何解释此限制的文档。此外,我目前使用的资源似乎太少而无法达到配额。
集群目前报告的总 CPU 配置为 3.25,内存为 12 GB。
这是使用 6 个部署,每个部署 1 个 pod。我无法想象这是 GKE 中单个可用区的限制。
日志一直在更新,这让我相信 GKE 正在尝试扩展,但它一直被拒绝。我需要知道为什么以及如何解决这个问题。
Kubernetes 版本:1.19.9-gke.1900
【问题讨论】:
标签: kubernetes google-cloud-platform google-kubernetes-engine