【发布时间】:2014-09-10 05:45:26
【问题描述】:
我正在尝试使用 R 筛选此页面中的网球结果数据(逐点数据,而不仅仅是最终结果)。
http://www.scoreboard.com/au/match/wang-j-karlovic-i-2014/M1mWYtEF/#point-by-point;1
使用常规的 R 屏幕抓取功能,如 readlines()、htmlParseTree() 等,我能够抓取页面的源 html,但不包含结果数据。
是否可以从页面中抓取所有文本,就像我在浏览器中的页面上并选择所有然后复制一样?
【问题讨论】:
-
..结果数据?比赛结果?
标签: r screen-scraping