【发布时间】:2018-01-31 19:05:06
【问题描述】:
我有一个看起来像这样的数据框
A B C D E
a b .1 .3 .9
c d .2 .4 .5
b a .1 .3 .9
d c .2 .4 .5
由于第 3 行和第 4 行与第 1 行和第 2 行相同,我需要将它们删除。最终的数据框将如下所示
A B C D E
a b .1 .3 .9
c d .2 .4 .5
df.drop_duplicates 只删除相似对而不是镜像对。有没有什么简单的方法可以在 pandas 中实现以删除此类镜像副本。谢谢!
编辑: 我刚刚尝试了 drop_duplicates(subset=['C','D','E']) ,它会给出这个数据框的结果。是否有任何其他基于“A”、“B”的解决方案。
【问题讨论】:
-
A和B列是不同的。你如何定义“相同”? -
@Alex 他将它们视为“镜子”。