【发布时间】:2019-05-19 19:01:19
【问题描述】:
我正在开发一个电影推荐系统(学校项目)。对于这个项目,人们对电影进行了评级。当有人没有看到电影时,数据集中会显示 NA。因此,我正在寻找一种方法来摆脱没有人看过的电影。这些是每个人都有 NA 的行。
问题在于并非所有列都用于对电影进行评级。喜欢带有标题的列。如何子集包含评分的列 (4:17),并删除这些列中所有包含 NA 的行?
ratingMovie <- ratingMovie[, rowSums(is.na(ratingMovie)) != ncol(ratingMovie), ]
我尝试运行上面的代码,但我不确定如何在此代码中添加子集。当我运行此代码时,我收到错误消息“选择了未定义的列”。
【问题讨论】: