【发布时间】:2020-06-23 03:38:53
【问题描述】:
我正在尝试从 nse 网站 (link) 抓取基本面数据表(市盈率、市盈率和股息收益率)。我从 rvest 包中尝试了以下内容:
url = "https://www1.nseindia.com/products/content/equities/indices/historical_pepb.htm"
pgsession <-html_session(url)
但是,我收到了这个错误:
Error in curl::curl_fetch_memory(url, handle = handle) :
LibreSSL SSL_read: SSL_ERROR_SYSCALL, errno 60
另外,我尝试了 httr 包(使用 Chrome 扩展“SelectorGadget”识别的 css 选择器)
fd <- list(submit = "Get Data", # Not Sure if it's the correct css selector
IndexName = "NIFTY 50",
fromDate = "01-06-2020",
toDate = "15-06-2020" )
resp<-POST(url, body=fd, encode="form")
但是,我收到了同样的错误。我扫描了许多论坛以解决问题,但似乎该网站阻止了抓取尝试。有人可以验证这一点或提供一种从该网站上抓取表格的方法吗?
【问题讨论】:
标签: html r curl web-scraping rvest