【问题标题】:Mahout itemsimilarity - maxPrefs parameterMahout itemsimilarity - maxPrefs 参数
【发布时间】:2014-12-12 14:35:45
【问题描述】:

在 itemsimilarity 方法中,有一个参数,如:

--maxPrefs (-mppu) maxPrefs - 最大数量 偏好 考虑每个用户或 项目、用户或项目 有更多偏好 将被采样 (默认:500)

它是如何工作的? 如果我有 500 万用户和 5000 个项目,并且我使用默认的 maxPrefs 运行 itemsimilarity,它只考虑这 500 万个中的 500 个排名还是什么?是采样吗?我可以做些什么来强制计算所有输入数据?

定义中的“或”是什么意思: “每个用户或项目要考虑的最大偏好数”

【问题讨论】:

    标签: mahout mahout-recommender


    【解决方案1】:

    这已在邮件列表中得到答复:http://article.gmane.org/gmane.comp.apache.mahout.user/20827/match=

    基本上,几种形式的下采样恰好可以在保持运行时间为 O(n) 执行时间的同时保持高质量。

    将 --maxPrefs (-mppu) maxPrefs 更改为 4000 或最大整数值以包括所有。

    【讨论】:

      猜你喜欢
      • 2017-08-06
      • 2016-02-06
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 1970-01-01
      • 2011-05-10
      • 2014-09-29
      相关资源
      最近更新 更多