【发布时间】:2019-08-08 12:12:24
【问题描述】:
我正在尝试删除 df 中两个 cols 的重复值 - 我没有收到错误,但代码运行但没有删除 dups -
首先,我运行下面的函数来删除所有可能的重复组合,如下所示 -
def remove_dup_combos(df):
u = df.filter(like='id').values
m = pd.DataFrame(np.sort(u, axis=1)).duplicated()
df = df[~m]
return df
这会删除所有重复的组合
我现在尝试使用
删除两个 id cols 中的所有 dupdef remove_dups(df):
df = df.drop_duplicates(['id1', 'id2'],keep='first')
return df
但这并没有给我预期的输出,并且输出与上面的第二个输出相同
谢谢!
【问题讨论】:
标签: python-3.x pandas dataframe duplicates data-analysis