【发布时间】:2020-02-05 15:23:29
【问题描述】:
我有两个名为 test1.csv 和 test2.csv 的 csv 文件,它们都有一个名为“名称”的列。我想比较两个文件之间的 Name 列中的每一行,并将不匹配的行输出到第三个文件。我看过一些使用熊猫的例子,但没有一个适合我的情况。任何人都可以帮我写一个脚本吗?
Test2 将被更新以包含来自 test1 的所有值以及未包含在 test1 中的新值(这是我想要保存到第三个文件中的值)
列的外观示例如下:
test1.csv:
Name Number Status
gfd454 456 Disposed
3v4fd 521 Disposed
th678iy 678 Disposed
test2.csv
Name Number Status
gfd454 456 Disposed
3v4fd 521 Disposed
th678iy 678 Disposed
vb556h 665 Disposed
【问题讨论】:
-
你的两列长度相等吗?还是有一些标识符可以用来匹配它们?提供一些样本数据会很有用
-
@Dan 不幸的是,它们的长度不相等。该列得到更新,因此在每个新文件中添加了更多内容。我希望它只在第三个文件中包含新的。
-
@pythonscrub 你是否认为 test2.csv 会添加更多名称并且你想找到它们?
-
@Dan 添加了一个带有额外值的列示例,由于它与 test1 文件输出不匹配,因此我想将其移至第三个文件。
-
@balderman 是的,test2 将包括来自 test1 的所有值以及我想要保存到第三个文件的新值。
标签: python pandas csv difference