【问题标题】:Failed to provision volume with StorageClass "slow": Failed to get GCE GCECloudProvider with error <nil>无法使用 StorageClass“慢”配置卷:无法获取 GCE GCECloudProvider 并出现错误 <nil>
【发布时间】:2019-10-18 13:21:54
【问题描述】:

我正在尝试从 GKE 中安装 Redis 集群 (StatefulSet),当我得到 pvc 时,我得到了

Events:
  Type       Reason              Age   From                         Message
  ----       ------              ----  ----                         -------
  Warning    ProvisioningFailed  10s   persistentvolume-controller  Failed to provision volume with StorageClass "slow": Failed to get GCE GCECloudProvider with error <nil>

已经在文件 /etc/kubernetes/manifests/kube-controller-manager.yaml 和 sudo vi /etc/kubernetes/manifests/kube-apiserver.yaml 上添加了“--cloud-provider=gce”。重新启动但还是一样。 任何人都可以帮助我吗?让 k8s 在 GCP 上运行的诀窍是什么?

我的清单来自here

---
apiVersion: v1
kind: ConfigMap
metadata:
  name: redis-cluster
  labels:
    app: redis-cluster
data:
  fix-ip.sh: |
    #!/bin/sh
    CLUSTER_CONFIG="/data/nodes.conf"
    if [ -f ${CLUSTER_CONFIG} ]; then
      if [ -z "${POD_IP}" ]; then 
        echo "Unable to determine Pod IP address!"
        exit 1
      fi
      echo "Updating my IP to ${POD_IP} in ${CLUSTER_CONFIG}"
      sed -i.bak -e "/myself/ s/[0-9]\{1,3\}\.[0-9]\{1,3\}\.[0-9]\{1,3\}\.[0-9]\{1,3\}/${POD_IP}/" ${CLUSTER_CONFIG}
    fi
    exec "$@"
  redis.conf: |+
    cluster-enabled yes
    cluster-require-full-coverage no
    cluster-node-timeout 15000
    cluster-config-file /data/nodes.conf
    cluster-migration-barrier 1
    appendonly yes
    protected-mode no
---
kind: StorageClass
apiVersion: storage.k8s.io/v1
metadata:
  name: slow
provisioner: kubernetes.io/gce-pd
parameters:
  type: pd-standard
  replication-type: none
  zone: "us-west2-a"
  reclaimPolicy: Retain
---
apiVersion: v1
kind: Service
metadata:
  name: redis-cluster
  labels:
    app: redis-cluster
spec:
  ports:
  - port: 6379
    targetPort: 6379
    name: client
  - port: 16379
    targetPort: 16379
    name: gossip
  clusterIP: None
  selector:
    app: redis-cluster
---
apiVersion: apps/v1
kind: StatefulSet
metadata:
  name: redis-cluster
  labels:
    app: redis-cluster
spec:
  serviceName: redis-cluster
  replicas: 5
  selector:
    matchLabels:
      app: redis-cluster
  template:
    metadata:
      labels:
        app: redis-cluster
    spec:
      containers:
      - name: redis
        image: redis:5.0-rc
        ports:
        - containerPort: 6379
          name: client
        - containerPort: 16379
          name: gossip
        command: ["/conf/fix-ip.sh", "redis-server", "/conf/redis.conf"]
        args:
        - --cluster-announce-ip
        - "$(POD_IP)"
        readinessProbe:
          exec:
            command:
            - sh
            - -c
            - "redis-cli -h $(hostname) ping"
          initialDelaySeconds: 15
          timeoutSeconds: 5
        livenessProbe:
          exec:
            command:
            - sh
            - -c
            - "redis-cli -h $(hostname) ping"
          initialDelaySeconds: 20
          periodSeconds: 3
        env:
        - name: POD_IP
          valueFrom:
            fieldRef:
              fieldPath: status.podIP
        volumeMounts:
        - name: conf
          mountPath: /conf
          readOnly: false
        - name: data
          mountPath: /data
          readOnly: false
      volumes:
      - name: conf
        configMap:
          name: redis-cluster
          defaultMode: 0755
  volumeClaimTemplates:
  - metadata:
      name: data
      labels:
        name: redis-cluster
    spec:
      accessModes: [ "ReadWriteOnce" ]
      storageClassName: slow 
      resources:
        requests:
          storage: 5Gi

【问题讨论】:

标签: kubernetes google-kubernetes-engine


【解决方案1】:

请验证您的“StorageClass:slow”,似乎有缩进问题(以reclaimPolicy开头)

kind: StorageClass
apiVersion: storage.k8s.io/v1
metadata:
  name: slow
provisioner: kubernetes.io/gce-pd
parameters:
  type: pd-standard
  replication-type: none
  zone: "us-west2-a"
reclaimPolicy: Retain

# 更新:

  1. 请将--cloud-provider=gce 添加到:kube-apiserver.yaml, kube-controller-manager.yaml, KUBELET_KUBECONFIG_ARGS。您还可以启用 enable-admission-plugins=DefaultStorageClass

  2. “云 API 访问范围”权限中验证您的 “VM 实例详细信息” 权限。

  3. 验证您的存储类 pv 和 pvc 是否正常工作。


  kind: StorageClass
    apiVersion: storage.k8s.io/v1beta1
    metadata:
      name: slow
      annotations:
        storageclass.beta.kubernetes.io/is-default-class: "true" 
    provisioner: kubernetes.io/gce-pd
    parameters:
      type: pd-standard      

  apiVersion: v1
    kind: PersistentVolumeClaim
    metadata:
     name: pvc-test
    spec:
     accessModes:
      - ReadOnlyMany
     storageClassName: slow
     resources:
       requests:
         storage: 1Gi

【讨论】:

    【解决方案2】:

    Google 提供两种主要类型的永久性磁盘,它们在 kubernetes 上自动配置:

    Standard storage (labeled pd-standard)
    SSD storage (labeled pd-ssd)
    

    默认情况下,GKE 将配置标准存储永久性磁盘。事实上,这是唯一可用的存储类。

    apiVersion: storage.k8s.io/v1
    kind: StorageClass
    metadata:
      name: test-storageclass
    provisioner: kubernetes.io/gce-pd
    parameters:
      type: pd-ssd
    

    您可以通过以下键/值对告诉持久卷使用新的 ssd 存储类:storageClassName: ssd.

    kind: PersistentVolumeClaim
    apiVersion: v1
    metadata:
      name: ssd-storageclass
    spec:
      accessModes:
        - ReadWriteOnce
      storageClassName: ssd
      resources:
        requests:
          storage: 1Gi
    

    【讨论】:

    • Txs Harsh,但是我仍然不清楚:您是要我将存储类型更改为 ssd 吗?如果是这样,不幸的是没有工作。仍在等待中:kubectl get events LAST SEEN TYPE REASON OBJECT MESSAGE 37s Warning ProvisioningFailed persistentvolumeclaim/data-redis-cluster-0 Failed to provision volume with StorageClass "slow": Failed to get GCE GCECloudProvider with error 你能澄清一下吗?发送!我开始认为,在 GKE 之外,GCP 不允许你故意运行 K8s...
    • 您好,能否提供更多信息:kubectl get pvc,pv, kubectl get events, journactl -u kubelet, systemctl status kubelet
    • 嗨,Jirene,我已经申请了更新。请验证并提供上述日志。也请运行kubectl get sc。分享结果。
    猜你喜欢
    • 1970-01-01
    • 2018-10-10
    • 2020-01-15
    • 2021-05-18
    • 2022-01-17
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2019-09-20
    相关资源
    最近更新 更多