【发布时间】:2017-10-16 22:47:40
【问题描述】:
我有一个包含 15 条记录的 csv 文件,其中包含类别/子类别。
列:Main_category,Sub_category,Count
期望的结果:Category,Sub_cat1,50
我用 Python pandas 试了一下,得到了上面的结果:
test = pd.DataFrame(df.groupby(['Main_category','Sub_category']['Sub_category'].count())
我正在尝试在 R 中使用 sqldf 来实现相同的目的,但没有获取某个类别的每个子类别的计数。它只显示总数:
sqldf("select Main_category, Sub_category, count(*) from MyData group by Main_category")
【问题讨论】:
-
你有
group by Main_category的地方,改成group by Main_category, Sub_category
标签: sql r dataframe group-by sqldf