【问题标题】:readHTMLTable() returning a List of 0readHTMLTable() 返回一个 0 的列表
【发布时间】:2019-04-13 14:19:40
【问题描述】:

我正在尝试使用 R 中的 readHTML() 函数读取表格。但得到的结果 - 0 列表和错误消息如下:

"XML 内容似乎不是 XML: 'https://www.forbes.com/powerful-brands/list/#tab:rank' "

我已经尝试在readHTMLTable()函数之前使用library(XML)library(RCurl)

到目前为止,我尝试了以下选项

library(XML)

Forbes=readHTMLTable("https://www.forbes.com/powerful-brands/list/#tab:rank",as.data.frame = TRUE)

另一种方式。

library(XML)
library(RCurl) 

URL<- "https://www.forbes.com/powerful-brands/list/#tab:rank"

Forbeslist <- readHTMLTable(getURL(URL))

收到以下错误消息:

"XML 内容似乎不是 XML: 'https://www.forbes.com/powerful-brands/list/#tab:rank' "

【问题讨论】:

  • 你能稍微改进一下你的格式吗?很难按原样阅读。只需使用四个空格来缩进代码并在您不想翻译成不同语言的小 sn-ps 周围使用反引号(例如变量和函数名称)。
  • 你应该尝试做一个最小的可重现的例子。
  • 感谢您的建议。我会确保在以后的帖子中考虑这些要点。

标签: r


【解决方案1】:

网站上的表格是由脚本生成的。如果您在浏览器中禁用脚本或仅使用wget https://www.forbes.com/powerful-brands/list/#tab:rank 下载页面,则可以看到它。 R 不执行脚本,所以它看不到任何表。

【讨论】:

    猜你喜欢
    • 2022-06-15
    • 1970-01-01
    • 2012-02-19
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 1970-01-01
    • 2013-04-10
    相关资源
    最近更新 更多