【问题标题】:Training Data Split across GPUs in DDP Pytorch Lightning在 DDP Pytorch Lightning 中跨 GPU 拆分训练数据
【发布时间】:2021-03-03 08:37:16
【问题描述】:

目标:使用 Pytorch Lightning 框架在分布式数据并行 (DDP) 设置中训练模型

问题:

  1. 训练数据分区:如何使用 Pytorch Lightning 处理跨不同 GPU 的数据分区?我应该手动对数据进行分区还是 Pytorch 闪电会解决这个问题?

  2. 平均损失:我是否必须自己汇总损失,否则 Pytorch Lightning 会自动执行此操作?

我一直花时间研究 pytorch 闪电的代码库,寻找如何处理 DDP 同步,但找不到确切的代码。希望对此作出澄清。

【问题讨论】:

    标签: pytorch-lightning


    【解决方案1】:

    Lightning 可以为您处理这两种情况,但它可以被覆盖。这个代码可以在官方githubhere找到。

    【讨论】:

      猜你喜欢
      • 2021-03-08
      • 2022-07-21
      • 2021-10-05
      • 2021-08-03
      • 1970-01-01
      • 2020-08-28
      • 2021-12-26
      • 1970-01-01
      • 2022-12-11
      相关资源
      最近更新 更多