【发布时间】:2023-03-31 11:18:01
【问题描述】:
我有一个类似this one 的链接,我想使用RCurl 从中提取数据,在此之前有一个免责声明页面,我需要在浏览器中单击它才能评估数据。以前我使用下面来自here 的脚本来“绕过”免责声明页面并使用RCurl 访问数据:
pagesource <- getURL(url,.opts=curlOptions(followlocation=TRUE,cookiefile="nosuchfile"))
doc <- htmlParse(pagesource)
以前可以,最近几天就不行了。其实我不太清楚它在做什么代码,我想知道我是否必须更改curlOptions中的某些内容,或者重新编写整段代码?
谢谢。
【问题讨论】:
-
这是您尝试访问的实际站点吗?我认为解决方案在很大程度上取决于站点。
-
@Jeff 是的,这是我想要访问的页面之一