【发布时间】:2019-02-10 23:39:55
【问题描述】:
我正在处理一个预测问题,需要一些帮助来解决它。我有一个包含两列 user_id 和 rating 的 CSV,其中用户对 rating 列中的某些内容进行评分。用户可以在 user_id 列中重复使用不同的唯一评级。例如:
user_id rating
1 5
4 6
1 6
7 6
2 7
4 7
现在预测数据集有用户已经给出了与上面类似的先前评分:
user_id rating
11 6
12 10
13 8
13 9
14 4
14 5
目标是预测这些特定用户下一次的评分。其次,假设我们添加一个没有评分历史的用户“15”,我们如何按顺序预测用户将提供的前两个评分。
我不确定如何仅使用 user_id 和评级来训练模型,这也恰好是目标列。任何帮助表示赞赏!
【问题讨论】:
标签: python machine-learning statistics data-science