【发布时间】:2022-01-24 16:09:39
【问题描述】:
我有一个 df = pd.DataFrame({'col1': ['A'] * 3 + ['B'] * 4 + ['C','B','A'],'col' :[2,3,4,2,4,2,1,3,4,4]})
我需要从两列中删除重复值,但只保留第一次出现的值。
试过了-
df = pd.DataFrame({'col1': ['A'] * 3 + ['B'] * 4 + ['C','B','A'],'col':[2,3,4,2,4,2,1,3,4,4]})
df = df.drop_duplicates(keep='first')
预期输出:
col1 col
0 A 1
1 B 2
2 C 3
3 4
【问题讨论】:
-
您的代码有什么问题,预期的输出是什么?看来您的代码运行良好。
-
您是指给定列中的重复行或重复值吗?当您说删除时,您的意思是删除整行吗?正如@SangkeunPark 所说,预期的输出会让这更有意义。
-
@SangkeunPark 输出仍有重复值 col1 col 0 A 2 1 A 3 2 A 4 3 B 2 4 B 4 6 B 1 7 C 3
-
@user17240949 最好在问题中添加您的问题和预期输出,而不是作为评论。
-
@user17240949 还是不明白。输出应该是什么样的?您必须展示您的预期输出。现在,您的结果看起来没有重复值