【发布时间】:2018-09-03 07:25:46
【问题描述】:
我正在尝试抓取一个网站,但它没有给我任何数据。
#Get the Data
require(tidyverse)
require(rvest)
#specify the url
url <- 'https://www.travsport.se/sresultat?kommando=tevlingsdagVisa&tevdagId=570243&loppId=0&valdManad&valdLoppnr&source=S'
#get data
url %>%
read_html() %>%
html_nodes(".green div:nth-child(1)") %>%
html_text()
character(0)
我也尝试使用xpath = '//*[contains(concat( " ", @class, " " ), concat( " ", "green", " " ))]//div[(((count(preceding-sibling::*) + 1) = 1) and parent::*)]//a',但这给了我相同的结果,数据为 0。
我期待马的名字。即使页面上的数据是由 javascript 呈现的,我至少应该得到一些 javascript 代码吗?
我看不出我还应该在这里使用什么 CSS 选择器。
【问题讨论】: