【发布时间】:2019-12-10 22:14:15
【问题描述】:
我正在做一个机器学习项目,我的数据集由数千张 X 光照片组成,每次我想处理这个项目时,我都必须重新加载图片并对其进行预处理,这非常耗时-消耗所以我想读取我的图像一次并将数千个 224x224x3 矩阵的列表写入一个文件中,我可以在每次需要处理这个项目时加载该文件。
我已经找到了一些允许我写/读列表的函数,但它们似乎没有写出整个矩阵,而只是写了一部分:
这是我用来编写文件的代码:
with open(obj_dir +"train_data_p", "w") as file:
file.write(str(train_data_p))
这是我用记事本打开训练数据集文件时得到的结果,从“...”部分可以看出,它只显示矩阵的 sn-ps:
[array([[[0.26666668, 0.26666668, 0.26666668],
[0.32156864, 0.32156864, 0.32156864],
[0.33333334, 0.33333334, 0.33333334],
...,
[0.75686276, 0.75686276, 0.75686276],
[0.77254903, 0.77254903, 0.77254903],
[0.7764706 , 0.7764706 , 0.7764706 ]],
[[0.27058825, 0.27058825, 0.27058825],
[0.28627452, 0.28627452, 0.28627452],
[0.31764707, 0.31764707, 0.31764707],
...,
[0.7607843 , 0.7607843 , 0.7607843 ],
[0.7647059 , 0.7647059 , 0.7647059 ],
[0.8039216 , 0.8039216 , 0.8039216 ]],
[[0.3019608 , 0.3019608 , 0.3019608 ],
[0.34901962, 0.34901962, 0.34901962],
[0.27058825, 0.27058825, 0.27058825],
...,
[0.78431374, 0.78431374, 0.78431374],
[0.7764706 , 0.7764706 , 0.7764706 ],
[0.78431374, 0.78431374, 0.78431374]],
...,
[[0.1254902 , 0.1254902 , 0.1254902 ],
[0.1254902 , 0.1254902 , 0.1254902 ],
[0.12156863, 0.12156863, 0.12156863],
如何写入/存储整个数据集,这样我就不必每次都读取和处理图像? 请帮帮我!
【问题讨论】:
-
考虑使用泡菜之类的东西
标签: python