【发布时间】:2021-03-20 04:21:20
【问题描述】:
我有这张桌子:
| A | B | C |
|---|---|---|
| Hello | A | C |
| Hello | B | C |
| Hello | C | C |
我想根据 A 列删除重复项,但只保留第三行,其中 B 列和 C 列具有相同的字符串:
| A | B | C |
|---|---|---|
| Hello | C | C |
我该怎么做?
提前致谢!
【问题讨论】:
标签: python python-3.x pandas dataframe duplicates
我有这张桌子:
| A | B | C |
|---|---|---|
| Hello | A | C |
| Hello | B | C |
| Hello | C | C |
我想根据 A 列删除重复项,但只保留第三行,其中 B 列和 C 列具有相同的字符串:
| A | B | C |
|---|---|---|
| Hello | C | C |
我该怎么做?
提前致谢!
【问题讨论】:
标签: python python-3.x pandas dataframe duplicates
你可以试试
df = df[df.C.eq(df.B) | ~df.A.duplicated(keep=False)]
【讨论】:
~ 上考虑 |
df = df[~df['A'].duplicated(keep=False)|(df['C']==df['B'])]
【讨论】: