【发布时间】:2017-07-29 21:15:57
【问题描述】:
df = pd.DataFrame({"ID":['A','B','C','D','E','F'],
"IPaddress":['12.345.678.01','12.345.678.02','12.345.678.01','12.345.678.18','12.345.678.02','12.345.678.01'],
"score":[8,9,5,10,3,7]})
我正在使用 Python 和 Pandas 库。对于那些具有重复 IP 地址的行,我只想选择得分最高的一行(得分从 0-10),然后删除所有重复项。
我很难将此逻辑转换为 Python 函数。
【问题讨论】:
-
df.loc[df.groupby('IPaddress')['score'].idxmax()]
-
Johnny,看起来您可能是 Stack 的新手,并且想知道为什么您可能会因为看似“正常”的问题而被否决。投反对票的原因是您没有发布您尝试过的内容,并且某些用户可能会认为我们正在“做你的功课”。事实上,这个问题和论坛上的其他人非常相似。将来,发布您尝试过的代码。阅读documentation 以获得更好的理解。我们祝你一切顺利,我希望你继续回来!
-
非常好。下次我会确保在帖子中包含我尝试过的内容。谢谢马特
标签: python-3.x pandas