【发布时间】:2021-06-05 04:08:37
【问题描述】:
我有一个小问题,如果可能的话希望得到一些帮助。
我有 2 个共享一些唯一值的大型 csv 文件,我想按字段 content 和 contentnum 中的唯一值拆分记录。然后,我想创建一个具有唯一值作为文件夹名称的子目录,例如 wax2 和 wax18 但将 2 个新数据集保存为相同的父文件名 large1.csv 和 large2.csv。如果子目录已经存在,则删除旧文件并写入新文件。
large1.csv
Content,Name,level,type
wax2,John,6,easy
wax2,Bob,12,hard
wax18,James,8,easy
wax18,Smith,16,hard
large2.csv
Contentnum,Color,level,type
wax2,Red,6,easy
wax2,Blue,12,hard
wax18,Blue,8,easy
wax18,Green,16,hard
所以我想拆分上面的两个 csv 文件,并在下面以文件夹名称作为值显示结果,例如 wax2/large1.csv & wax18/large2.csv
文件夹名称:Wax2 文件名:large1.csv
Content,Name,level,type
wax2,John,6,easy
wax2,Bob,12,hard
文件夹名称:Wax18 文件名:large2.csv
Content,Name,level,type
wax18,James,8,easy
wax18,Smith,16,hard
请有人帮我在 python 中执行此操作。谢谢。
我已经走到这一步了。
【问题讨论】:
-
嗨,到目前为止,您尝试了什么? SO 不应该是一个您可以要求某人为您编写程序的站点,而是一个针对特定编程相关问题的 Q/A 站点。请看how to ask
标签: python pandas dataframe csv split