【发布时间】:2016-03-09 09:33:23
【问题描述】:
我尝试创建一个返回文本文件中单词出现次数的函数。 为此,我创建了一个包含文本所有单词的列表。 (a, c,, c , d, e, f 在这里是示例词)
[[1]]
[1] a
[2] f
[3] e
[4] a
[[2]]
[1] f
[2] f
[3] e
我为每个单词创建了一个表来存储它的出现值的数量
table(unlist(list))
a b c d e
3 3 2 1 1
我现在的问题是如何提取参数中单词出现的值。 该函数将具有这种结构
GetOccurence <- function(word, table)
{
return(occurence)
}
任何想法请帮助我,在此先感谢
【问题讨论】:
-
使用 R 进行文本挖掘的主题描述得很好,如果你想考虑看看this article,你可以找到进行频率的基本方法对文本文件进行分析。
-
tm包在这里会有所帮助 -
您可以索引表,因为级别变成了名称。因此
table(mtcars$cyl)['6']返回mtcars中六缸汽车的数量。如果这是你的问题;这有点模棱两可。 -
好的,谢谢,但我的问题是,如果我想查找“hello”的频率,我该如何在参数中传递“hello”以提取其频率?
标签: r text find-occurrences