【发布时间】:2020-11-20 02:28:28
【问题描述】:
寻求建议如何创建映射两个列表的TF数据集并将数据集保存到CSV文件。
我创建了两个列表: 原版的: [b'文件 1.JPG', b'文件 2.JPG', b'文件 3.JPG', b'文件 4.JPG']
复制: [b'文件1.JPG副本', b'文件2.JPG副本', b'文件3.JPG副本', b'文件4.JPG副本']
需要将每个原始文件映射到相关的重复文件,并将它们保存到 CSV 文件中,其中包含 Original : Duplicate 列
我尝试通过运行将 TF 转换为 pandas 数据帧:
dataset = tf.data.Dataset.from_tensor_slices((original, dublicate))
def convert_to_dataframe(original, dublicate):
print(pd.DataFrame.from_records(original))
return original, dublicate
df = dataset.map( lambda original, dublicate:
tf.py_function(convert_to_dataframe,
[original, dublicate], Tout =tf.string)
iterator = df.make_one_shot_iterator()
original, dublicate = iterator.get_next()
当我尝试检查 df 是否为 pandas 数据框并将其保存到 CSV 文件时,我收到以下错误: AttributeError Traceback(最近一次调用最后一次) 在 () ----> 1 个迭代器 = df.make_one_shot_iterator() 2 原始,重复 = iterator.get_next()
AttributeError: 'MapDataset' 对象没有属性 'make_one_shot_iterator'
提前致谢
【问题讨论】:
标签: python pandas export-to-csv tensorflow2.0