【发布时间】:2019-12-18 10:51:16
【问题描述】:
我正在尝试从德国议会的主页中提取议会成员的姓名,但是,无论我尝试使用哪个 css 选择器或 xpath,它都不会返回任何内容。
https://www.bundestag.de/ausschuesse/a11#
#names <- landing_page_AS %>%
#html_nodes("main > div") %>%
#extract2(7) %>%
#html_nodes("h3") %>%
#html_text()
names <- landing_page_AS %>%
html_nodes(".bt-teaser-person-text h3") %>%
#html_nodes(xpath = "//*[(@id = "bt-collapse-538348")]//h3") %>%
#html_nodes(xpath = "//*[contains(concat( " ", @class, " " ),
concat( " ", "bt-teaser-person-text", " " ))]//h3") %>%
html_text()
【问题讨论】:
标签: html r xpath web-scraping css-selectors