【问题标题】:Cluster thousands of text documents in java在java中聚类数千个文本文档
【发布时间】:2011-05-30 08:55:23
【问题描述】:

有没有对文本文档进行聚类的有效方法?我考虑过 K-Means,但它似乎太耗时了。有人可以给我一个有效的方法吗?

【问题讨论】:

    标签: performance cluster-analysis k-means


    【解决方案1】:

    clustering algorithm 取决于您的数据集,您想用 java 编写一个算法来对您的文档进行聚类吗? ,您可以使用weka 而不是重新发明轮子并在您的数据集上尝试另一种聚类算法。

    【讨论】:

      【解决方案2】:

      如果 K-Means 确实可以完成这项工作,而且看起来很慢,那么为什么不尝试让它更快呢?我使用的方法是random-pausing

      通常情况下,在不更改基本算法的情况下,您不会认为代码有很大的加速空间。 Here's an example.

      【讨论】:

        猜你喜欢
        • 2015-04-27
        • 1970-01-01
        • 2019-06-19
        • 2012-09-05
        • 2013-02-01
        • 2011-08-16
        • 2013-06-08
        • 2012-03-01
        • 1970-01-01
        相关资源
        最近更新 更多