【发布时间】:2022-11-10 15:59:14
【问题描述】:
我有一个看起来像这样的数据框:
df =
date col1 col2 col3 col4
-----------------------------------------
2022/30/01 2 2 4 5
2022/30/01 2 2 4 5
2022/30/01 0 0 1 2
2022/30/01 0 0 1 2
2022/30/01 3 2 4 2
2022/30/01 5 8 4 3
所以基本上我的前两行是相同的,接下来的两行也是相同的,最后两行是不同的。
我想做的是删除重复的行,但只有那些col1和col2等于0的行,即生成的数据框应该是:
df_final =
date col1 col2 col3 col4
-----------------------------------------
2022/30/01 2 2 4 5
2022/30/01 2 2 4 5
2022/30/01 0 0 1 2
2022/30/01 3 2 4 2
2022/30/01 5 8 4 3
有什么方法可以轻松地完成此任务吗?我知道我可能可以对数据框进行某种排序,然后遍历每一行并检查条件。我只是怀疑如果有很多行,这可能是一个相当耗时的过程。
【问题讨论】: