【发布时间】:2015-04-20 05:11:44
【问题描述】:
我有以下格式的 csv 文件/表格数据,
UserId Item1 Item2
1 url1 url3
1 url4 url6
2 url2 url3
2 url2 url4
2 url4 url6
3 url4 url6
3 url2 url3
因此,如果 item1 的值已知,我想在这里为特定用户预测 item2。我们可以使用协同过滤吗?如果是,请指导:)
【问题讨论】:
-
到目前为止您所描述的可能是一个简单的数据库查询。
SELECT item2, count(*) FROM table WHERE item1 = '...' GROUP BY item2 ORDER BY COUNT(*)。你还有数据吗?用户是否对项目进行投票/评分? -
No extra Data :( 但是可以有额外的列,给出在 item1 之后访问 item2 的次数。不使用简单数据库查询的原因是,我想找出相似的用户并相应地推荐item2(我只是想试试这个不知道它是否有效)。
标签: recommendation-engine collaborative-filtering