【发布时间】:2015-06-26 14:45:14
【问题描述】:
我有一个数据框 df:
first_seen last_seen uri
0 2015-05-11 23:08:46 2015-05-11 23:08:50 http://11i-ssaintandder.com/
1 2015-05-11 23:08:46 2015-05-11 23:08:46 http://11i-ssaintandder.com/
2 2015-05-02 18:27:10 2015-06-06 03:52:03 http://goo.gl/NMqjd1
3 2015-05-02 18:27:10 2015-06-08 08:44:53 http://goo.gl/NMqjd1
我想删除具有相同“first_seen”、“uri”的行并仅保留具有最新 last_seen 的行。
这是expected 数据集的示例:
first_seen last_seen uri
0 2015-05-11 23:08:46 2015-05-11 23:08:50 http://11i-ssaintandder.com/
3 2015-05-02 18:27:10 2015-06-08 08:44:53 http://goo.gl/NMqjd1
有谁知道不写 for 循环的情况下谁来做?
【问题讨论】:
标签: python pandas compare dataframe rows