【问题标题】:AWS Batch, how to ask for GPUsAWS Batch,如何请求 GPU
【发布时间】:2019-07-09 13:32:24
【问题描述】:
我正在获取有关如何使用 AWS 批处理来训练深度学习模型的文档。这个想法是,一旦建立了模型,我想提交几个工作来探索一下超参数空间。
在这个interesting blog post 中,博主创建了一个 P2 实例的执行环境,并用它来为 MNIST 训练一个卷积神经网络。
我现在想知道在我的工作定义中是否可能需要特定数量的 GPU 而不是 vCPU。通过这种方式,我确信我的工作拥有所需的 GPU 数量。如果没有,有什么解决方法吗?
【问题讨论】:
标签:
deep-learning
aws-batch
【解决方案2】:
我相信你现在已经想通了,但不会受伤,对吧?不,到目前为止,还没有办法指定 GPU 数量。但是,您可以将 vCPU 计数分配给作业定义以指定多少 GPU。
例如,p2.xlarge 实例有 4 个 vCPU。因此,如果您希望为您的作业分配 1 个 GPU,则为该作业定义分配 4 个 vCPU。这样,每个 p2.xlarge 实例将只运行一个作业。这可能对所需的 vCPU 空间有点过分了,但这是目前指定您想要该作业并且该作业仅具有 GPU 的唯一方法。
我和 AWS 的人谈过,他们一直说 GPU 规范可能很快就会出现,但谁知道呢,真的。