【发布时间】:2014-02-15 23:54:56
【问题描述】:
我有一个由函数 lda.collapsed.gibbs.sampler 生成的模型,来自 lda 包,我需要知道最重要的词的“相关性”。 使用时
top.topic.words(result$topics, 10, by.score=TRUE)
我得到了每个主题的前 10 个词的列表,但我想查看这 10 个词所代表的主题百分比。我猜信息是存在的,因为有一个“分数”,但是我对Gibbs采样器的统计方法不是很熟悉。
提前致谢!
【问题讨论】:
-
你能解释一下你所说的主题百分比是什么意思吗?您是指该主题产生任何这些单词的概率吗?或者可能是吉布斯分配给这些主题词对的部分?
-
第二个,我想。我想知道这些词在这个话题中有多少“分量”。我不太确定它的正式表达方式:(
标签: r statistics lda