【问题标题】:Getting top terms per affinity propagation cluster in scikit-learn在 scikit-learn 中获取每个亲和传播集群的顶级术语
【发布时间】:2019-06-18 04:51:46
【问题描述】:

我正在为一堆新闻文本尝试不同的聚类方法,并且正在努力寻找任何方法来为 sklearns 亲和力传播找到每个聚类的热门术语,并且我不确定这是否可能。

对于 k-means 聚类,我使用与此处相同的方法:https://scikit-learn.org/0.19/auto_examples/text/document_clustering.html 从逻辑上讲,我希望使用与 k-means 相同的 X 进行亲和力传播。

有人知道如何通过亲和力传播产生类似的结果吗?

【问题讨论】:

    标签: scikit-learn cluster-analysis text-mining


    【解决方案1】:

    可以计算平均值,并以与 k-means 相同的方式对其进行分析。

    为了获得更好的结果,如果 sklearn API 公开了责任因素,您可以按责任因素衡量每个文档。

    【讨论】:

      猜你喜欢
      • 2019-05-15
      • 2023-01-22
      • 2019-12-09
      • 2017-03-11
      • 2019-06-09
      • 2015-02-13
      • 2017-02-07
      • 2013-07-21
      • 2015-04-05
      相关资源
      最近更新 更多