【问题标题】:R package Twitter to analyze tweets textR包Twitter分析推文文本
【发布时间】:2014-01-20 07:43:56
【问题描述】:

我正在使用 TwitteR 包(特别是 searchTwitter 函数)以 csv 格式导出包含特定主题标签的所有推文。

我想分析他们的文本并发现其中有多少包含我刚刚保存在名为importantwords.txt 的文件中的特定单词列表。

我如何创建一个函数来返回我在我的文件importantwords.txt 中写入的单词的推文数量?

【问题讨论】:

    标签: twitter hashtag tweets text-analysis twitter-r


    【解决方案1】:

    伪代码:

    > for (every word in importantwords.txt):
    >     int i = 0;
    >     for (every line in tweets.csv):
    >         if (line contains(word)):
    >             i = i+1
    >     print(word: i)
    

    这符合你想要的吗?

    【讨论】:

      【解决方案2】:

      我认为最好的办法是使用 tm 包。

      http://cran.r-project.org/web/packages/tm/index.html

      这个家伙用它来创建带有信息的词云。查看他的代码可能也会对您有所帮助。

      http://davetang.org/muse/2013/04/06/using-the-r_twitter-package/

      如果您的重要词只是为了避免“the”“a”之类的东西,这将很好。如果它特别针对某事,您需要使用您的单词列表遍历语料库以检索计数。

      希望对你有帮助 内森

      【讨论】:

        猜你喜欢
        • 2010-10-24
        • 1970-01-01
        • 1970-01-01
        • 1970-01-01
        • 1970-01-01
        • 2013-06-22
        • 1970-01-01
        • 1970-01-01
        • 2013-03-11
        相关资源
        最近更新 更多