【问题标题】:GCP Dataproc create cluster with gpus errorGCP Dataproc 创建集群时出现 gpus 错误
【发布时间】:2018-05-08 05:40:09
【问题描述】:

GCP Dataproc 服务现在支持创建具有 GPU 的集群作为测试版功能。我遇到的问题是,当我尝试指定GPU类型时,gcloud命令行无法识别我指定的类型。

我使用的 gcloud 命令如下所示。

gcloud beta dataproc clusters create gpu-cluster \
--zone us-east1-b \
--master-machine-type n1-standard-4 \
--master-boot-disk-size 100 \
--num-workers 2 \
--worker-machine-type n1-standard-1 \
--worker-boot-disk-size 50 \
--initialization-actions gs://15418-initial-script/initialize_cluster.sh \
--worker-accelerator type=nvidia-tesla-p100,count=1

我回来了:

ERROR: (gcloud.beta.dataproc.clusters.create) INVALID_ARGUMENT: Insufficient 'NVIDIA_K80_GPUS' quota. Requested 2.0, available 0.0.

有人知道发生了什么吗?我使用了错误的命令还是 gcloud 命令行有问题?

【问题讨论】:

  • 这也发生在我身上,所以我在内部报告它(GCP 支持)。但是,我注意到它在使用不同区域时选择了正确的参数
  • 也提交了一个公共问题:issuetracker.google.com/issues/79397747。为它加星以保持更新,感谢您的合作
  • Google 限制每个区域可以使用的资源数量。检查您的配额页面,并在必要时要求增加。

标签: google-cloud-platform gcloud google-cloud-dataproc


【解决方案1】:

您可能需要为 GPU 申请配额

查看项目的配额页面,确保项目中有足够的 GPU 配额(NVIDIA_K80_GPUS 或 NVIDIA_P100_GPUS)可用。如果配额页面上未列出 GPU,或者您需要额外的 GPU 配额,请申请增加配额。

【讨论】:

    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 2020-01-08
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2016-05-30
    • 2020-10-26
    • 1970-01-01
    相关资源
    最近更新 更多