【发布时间】:2019-02-06 11:14:07
【问题描述】:
在 EC2 p2.xlarge 实例上运行支持 GPU 的 docker 容器时,我在容器开始运行之前遇到了 30 到 90 秒的延迟。后续容器快速启动(延迟 1 秒)。
EC2 运行 ubuntu 18.04,NVIDIA 驱动程序版本 396.54 和 nvidia-docker2(按照官方安装指南:https://github.com/NVIDIA/nvidia-docker)
我正在使用最新的官方 CUDA 映像进行测试: docker run --rm nvidia/cuda nvidia-smi
我的机器上启用了持久模式。如https://github.com/NVIDIA/nvidia-docker/wiki/Frequently-Asked-Questions#how-do-i-install-the-nvidia-driver 中所述,“为什么我的容器从 2.0 开始很慢?”它应该是解决方案,但对我不起作用。
感谢任何可能导致延迟的想法以及如何解决它。
【问题讨论】:
-
也许问的很明显,但是您是否在第一次执行之前拉取了 nvidia/cudai 图像?如果不是,那是预期的行为,因为它必须首先拉取图像,它们至少有 0.5 GB。
-
是的,我确实先拉取了图像。 30到90秒的延迟不包括拉取镜像所需的时间
标签: docker amazon-ec2 nvidia nvidia-docker