【发布时间】:2015-01-19 18:37:42
【问题描述】:
我想从
中提取“Match match by list”表http://stats.espncricinfo.com/ci/engine/player/50710.html?class=2;template=results;type=batting;view=match
我是 R 新手,所以不太了解从网页中提取数据。我使用此代码来提取表格。
fileUrl<- "http://stats.espncricinfo.com/ci/engine/player/50710.html?class=2;template=results;type=batting;view=match"
#load
sanga <-htmlTreeParse(fileUrl, useInternal=T)
sanga.data <-xpathSApply(sanga,"//tr[@class='data1']",xmlValue)
但是,我最终得到一个单列矩阵,其中原始表中的每一列都表示为一行。我阅读了此线程中的信息,但仍然无法弄清楚如何以表格格式获取数据。 Scraping html tables into R data frames using the XML package
【问题讨论】:
-
XML包有一个readHTMLTable函数。您可以使用readHTMLTable(sanga, which = 50)或readHTMLTable(sanga)$"Match by match list"。
标签: r web-scraping