【发布时间】:2021-09-04 02:13:45
【问题描述】:
想知道这种类型的数据清理是否已经在 pandas 中完成。 我有以下数据框(列继续有更多日期,但这是一个示例)
d = {'Date' : ["Spiderman total",
"Division A",
"Division B",
"Division C",
"Superman total",
"Division A",
"Division B",
"Division C"
],
'1/4/20': [3,1,2,0,10,5,3,2],
'1/11/20':[5,2,1,2,8,4,4,0],
'1/18/20': [15,7,7,1,20,10,0,10]
}
df = pd.DataFrame(data=d)
我想将该数据帧转换成这种格式(这是 20 年 1 月 4 日的一个示例,但最终希望获得初始数据帧中的所有日期)
b = {'date':['1/4/20','1/4/20','1/4/20','1/4/20','1/4/20','1/4/20'],'Business':['Spiderman','Spiderman','Spiderman','Superman','Superman','Superman'],
'Division':['A','B','C','A','B','C'],
'totals':[1,2,0,5,3,2]}
dt = pd.DataFrame(data=b)
不需要业务总数,因为它可以作为部门的总和获得,但我必须将名称(在这种情况下例如蜘蛛侠)放在业务列中。
我想知道这在 pandas 中是否可行,或者我应该尝试其他方法。
【问题讨论】:
-
你真的有 Excel 中的数据吗?