【发布时间】:2019-08-05 14:31:05
【问题描述】:
我有以下问题,我打开了许多 3D 卷文件以提取一堆 numpy 数组。 我想随机获取这些数组,即在最坏的情况下,如果所有这些数组都在单独的文件中,我会打开与我想要获取的 numpy 数组一样多的 3D 卷。 这里的 IO 不是很好,我打开一个大文件只是为了从中获取一个小的 numpy 数组。 知道如何存储所有这些数组以使 IO 更好吗? 我无法预先读取所有数组并将它们全部保存在一个文件中,因为那样该文件将太大而无法打开 RAM。
我查找了 LMDB,但它似乎都是关于 Caffe 的。 知道如何实现这一目标吗?
【问题讨论】:
标签: python machine-learning dataset pytorch lmdb