【发布时间】:2019-01-30 15:38:46
【问题描述】:
样本 DF
data = {'name': ['Jason , Jason', 'Molly', 'Tina', 'Jake', 'Amy'],
'year': ['2012 , 2012 , 2016 , 2016', 2012, 2013, 2014, 2014],
'reports': ['4 , 4 , 5 , 6 , 6 , 7', 24, 31, 2, 3]}
df1 = pd.DataFrame(data, index = ['Cochice', 'Pima', 'Santa Cruz', 'Maricopa', 'Yuma'])
看起来像:
name ... year
Cochice Jason , Jason ... 2012 , 2012 , 2016 , 2016
Pima Molly ... 2012
Santa Cruz Tina ... 2013
Maricopa Jake ... 2014
Yuma Amy ... 2014
我希望Cochice 索引的每个单元格都有唯一值。我尝试了drop_duplicates 和nunique,但它们都不起作用。
在我原来的 df 中,列数可以超过 3
输出 Df
name reports year
Cochice Jason 4,5,6,7 2012,2016
Pima Molly 24 2012
Santa Cruz Tina 31 2013
Maricopa Jake 2 2014
Yuma Amy 3 2014
【问题讨论】:
-
您的真实数据在逗号前是否有空格(例如在您的“Jason ,Jason”条目中)或者这只是一个错字?
-
实际上我在所有值中都有空间..让我更新问题
标签: python-3.x pandas unique