【问题标题】:Error Crawling Data Twitter With R Programming使用 R 编程在 Twitter 上抓取数据时出错
【发布时间】:2019-11-14 16:31:38
【问题描述】:

如何解决这样的错误:

library(twitteR)
library(ROAuth)
customer_key<-"-aaaaaa"
customer_secret<-"aaaaaaaa"
access_token<-"212123213-aaaaa"
access_secret<-"ccccccccccccc"
setup_twitter_oauth(customer_key,customer_secret,access_token,access_secret)
Tweets = searchTwitter("anxiety", n=100, lang = "en")

错误:引用类字段“语言”的分配无效,应该来自类“字符”或子类(是类“NULL”)

我使用 RStudio 来运行这个源代码,这是我第一次使用 twitter API。在我看到教程之前他们成功了,在我尝试之后出现了这样的错误。谢谢你

【问题讨论】:

  • 我建议改用rtweet 库。身份验证比twitteR 容易得多,并且数据结构更合理。
  • :@neilfws 但是如果你使用rtweet,如果你在爬取数据和预处理的时候使用rtweet,那么应该是twitteR的代码就不能使用了。如果使用 twitteR 获得的数据有 19 个变量,而 rtweet 有 90 个变量。你能给我一个网站来学习使用 rtweet。 # 我用它来进行文本挖掘

标签: r twitter twitter-oauth


【解决方案1】:
consumer_key <- "xxxxxxxxxxxxxxxxxxxxxxxxxxxxx"
consumer_secret <- "xxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxx"
access_token <- "xxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxxx"
access_secret <- "xxxxxxxxxxxxxxxxxxxxxxxxxxxxx"

以下步骤是使用关键字#statistics提取Twitter并检索10000条数据的过程

setup_twitter_oauth(consumer_key, consumer_secret, access_token, access_secret)
tw = searchTwitter('#statistics',
                n = 10000,
               retryOnRateLimit = 1617)

确保您使用的令牌已更新,并且您将刮这个词是“焦虑”的可能性在过去 7 天内不存在。因为使用 API 进行抓取只会提取 7 天前的数据。假设我在 8 号提取数据,将要拉取的数据是 2 号到 8 号包含“焦虑”一词的数据或句子。

【讨论】:

    猜你喜欢
    • 2022-11-17
    • 2023-04-03
    • 2019-05-06
    • 1970-01-01
    • 1970-01-01
    • 2019-10-02
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    相关资源
    最近更新 更多