【发布时间】:2019-04-07 16:10:00
【问题描述】:
我正在使用 TensorFlow 对象检测 API 在 V100 GPU 上训练检测模型。由于它具有可用的张量核心,是否有任何配置标志/kwarg 可用于打开混合精度训练?不确定这是否是当前功能。类似于model_main.py --mixed 的东西如果存在的话会很棒。
【问题讨论】:
标签: tensorflow precision object-detection-api mixed
我正在使用 TensorFlow 对象检测 API 在 V100 GPU 上训练检测模型。由于它具有可用的张量核心,是否有任何配置标志/kwarg 可用于打开混合精度训练?不确定这是否是当前功能。类似于model_main.py --mixed 的东西如果存在的话会很棒。
【问题讨论】:
标签: tensorflow precision object-detection-api mixed
昨天(5 月 16 日)Nvidia 展示了自动混合精度,它极大地简化了此功能的实现,大大降低了工作量:添加一行代码,瞧!!!。
网络直播好像已经录制好了,可以点播,同时这里是链接:
https://developer.nvidia.com/automatic-mixed-precision
https://devblogs.nvidia.com/nvidia-automatic-mixed-precision-tensorflow/
还讨论了实施 MP/AMP 时应避免的策略、工具和事项。
有一篇优秀的论文讨论了混合精度的实现(除其他外)。我准备了这个 4 分钟的视频,总结了研究“用高性能分布式计算增强 AI”
顺便说一句,根据 Nvidia 的说法,MP 可以在 Volta 和 Turing GPU(即 Google Collab 使用 Voltas V100!)和 AMP(TF1.14 上集成自动混合精度)上有效实现
【讨论】: