【发布时间】:2015-10-08 07:27:57
【问题描述】:
我有一个数据框
x userId bookId rating
1 1 412 6
2 1 454 5
3 2 412 4
等等。
基本上,一个用户给很多书评分,而一本书有很多评分。
我需要提取一些关于userId 的描述性统计信息。给出的平均评分数量,给出的平均评分等。
谁能指点我正确的方向?
【问题讨论】:
-
看看
help("aggregate")。 -
或从
dplyr尝试mutate -
或者尝试用
data.table包在SO上搜索总结...library(data.table);setDT(df)[,list(avAmount=length(unique(bookID)), avRating=mean(rating)),userID] -
@DatamineR
dplyr::mutate只不过是"$<-"。这就像说“尝试使用 R”