【发布时间】:2015-12-24 13:40:30
【问题描述】:
我对工作流程的理解是运行 LDA -> 提取关键字(例如每个主题的前几个单词),从而降低维度 -> 一些后续分析。
我的问题是,如果我的总体目的是以无监督的方式为文章提供主题,或者将类似的文档聚集在一起,那么 LDA 的运行将直接带您实现目标。为什么要降维,然后传递给后续分析呢?如果可以,LDA之后可以做什么样的后续分析?
还有一个无关紧要的问题——在这里问这个问题还是在交叉验证时问这个问题更好?
【问题讨论】:
-
Cross Validated 不适合问这个问题(个人经验)。数据科学更适合。
标签: machine-learning nlp text-mining lda topic-modeling