【问题标题】:Unique values based on multiple columns基于多列的唯一值
【发布时间】:2017-06-28 17:26:10
【问题描述】:

我有 2 列包含重复条目。请参见下面的示例。 我想从两列中删除重复项 原始列

MatchN  Striker
1000887 DA Warner
1000887 DA Warner
1000887 TM Head
1000887 TM Head

我想最终得到结果

MatchN  Striker
1000887 DA Warner
1000887 TM Head

我尝试过使用

np.df[["MatchN"],["Striker"]].unique()

但它不起作用。

任何人都可以建议获得所需结果的最佳方法吗?

【问题讨论】:

    标签: python python-3.x pandas dataframe


    【解决方案1】:

    IIUC 你需要DataFrame.drop_duplicates() 方法:

    In [69]: df = df.drop_duplicates(['MatchN','Striker'])
    
    In [70]: df
    Out[70]:
        MatchN    Striker
    0  1000887  DA Warner
    2  1000887    TM Head
    

    【讨论】:

    • df.drop_duplicates(["MatchN"],["Striker"]) 不起作用
    • @AnoopMahajan,您应该发布了一个可重复的数据集...请检查更新的答案
    • @AnoopMahajan,很高兴我能帮上忙 :)
    猜你喜欢
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2019-06-02
    • 2016-05-15
    • 1970-01-01
    • 1970-01-01
    • 2020-10-01
    相关资源
    最近更新 更多