【发布时间】:2021-12-01 08:36:39
【问题描述】:
我在开始训练我的对象检测 Tensorflow 2.5 GPU 模型时遇到资源耗尽错误。我正在使用 18 个训练图像和 3 个测试图像。我使用的预训练模型是来自 Tensorflow zoo 2.2 的 Faster R-CNN ResNet101 V1 640x640 模型。 我正在使用具有 8 GB 专用内存的 Nvidia RTX 2070 来训练我的模型。
我感到困惑的是,为什么在训练集很小的情况下,训练过程会占用我 GPU 的大量内存。这是我与错误一起获得的GPU内存摘要:
Limit: 6269894656
InUse: 6103403264
MaxInUse: 6154866944
NumAllocs: 4276
MaxAllocSize: 5786902272
Reserved: 0
PeakReserved: 0
LargestFreeBlock: 0
我还将训练数据的批量大小减少到 6,测试数据的批量大小减少到 1。
【问题讨论】:
标签: tensorflow out-of-memory tensorflow2.0 object-detection object-detection-api