【发布时间】:2017-10-26 13:50:34
【问题描述】:
我有一个数据集,其中包含各种产品的每周销售量。以下是数据的样子:
Store ID Week ID Item Code Sales in $
253422 191 41130 2.95
272568 188 41130 2.95
272568 188 41160 2.95
272568 189 41130 2.95
272568 189 41160 2.95
272568 190 41160 2.95
217460 188 41110 2.95
217460 188 41130 5.9
217460 188 41160 5.9
217460 189 41110 11.8
217460 189 41130 8.85
217460 189 41160 11.8
217460 191 41130 5.95
217460 191 41160 8.93
这是一个非常大的数据集,我想生成一个摘要输出,它为我提供了 ITEM 明智的总销售额和该项目所在的商店数量。我尝试了以下方法,但这不起作用,因为我得到了一个由于数据集中重复数周而重复的商店计数:
dataset %>% group_by(Store ID) %>% summarize(count(Item Code))
非常感谢任何帮助。 谢谢
【问题讨论】:
-
你能把你的数据格式化成一个表格,这样更容易阅读它的样子吗?
-
对不起@Adam,我的第一篇文章,我没有意识到我发布的格式会很糟糕!
-
dataset %>% group_by(ItemCode) %>% summarize(total.sales = sum(Sales), stores = n_distinct(StoreID))
标签: r dataframe count dplyr summarize