【发布时间】:2020-11-05 20:36:46
【问题描述】:
以下是相关 df 的简化版本的脚本:
import pandas as pd
df = pd.DataFrame({
'id': ['1', '1','2','2','3','3','4','4','5','6','7'],
'product1_expiry_date' : ['-','-','2020-11-28','2020-11-13','-',
'2020-11-13','2020-12-13','-','2020-11-16','-',
'2020-11-28'],
'product2_expiry_date' : ['2020-11-16','2020-11-19','-',
'-','2020-11-23','2020-11-13',
'2020-12-13','-','2020-12-01','2020-12-01',
'2020-12-14']
})
df
id product1_expiry_date product2_expiry_date
1 - 2020-11-16
1 - 2020-11-19
2 2020-11-28 -
2 2020-11-13 -
3 - 2020-11-23
3 2020-11-13 2020-11-13
4 2020-12-13 2020-12-13
4 - -
5 2020-11-16 2020-12-01
6 - 2020-12-01
7 2020-11-28 2020-12-14
我不希望有重复的 ID,对于每个 ID,删除较早的日期和适用的“-”值。因为我只对以后的日期感兴趣。
预期的 DF:
id product1_expiry_date product2_expiry_date
1 - 2020-11-19
2 2020-11-28 -
3 2020-11-13 2020-11-23
4 2020-11-13 2020-11-13
5 2020-12-13 2020-12-13
6 2020-11-16 2020-12-01
7 2020-11-28 2020-12-14
任何帮助将不胜感激。
【问题讨论】: