【发布时间】:2016-05-24 23:38:40
【问题描述】:
我有一个包含数千行的 Pandas 数据框,以及这些列:
Name Job Department Salary Date
我想返回一个带有两个列的新 df:
Unique_Job Avg_Salary
我用来完成此操作的代码:
jobs = df.groupby(['Job'])
dict = {}
for a,b in jobs:
dict.update({a: b['Salary'].mean()})
dfJobs = pd.DataFrame(dict.items(), columns=['Unique_Job', 'Avg Salary'])
但是,我知道一定有更好的方法。想法?谢谢。
【问题讨论】:
-
你是在
jobs['Salary'].mean()之后,因为你已经在工作分组,所以我不明白需要再次迭代工作吗? -
我认为 EdChum 击中了它的鼻子。 mean() 将汇总每个组的数据。
标签: python python-2.7 pandas group-by