【发布时间】:2018-03-01 10:51:06
【问题描述】:
我正在尝试使用 R 对该网页的标题内容进行网络抓取,但 rvest 并不是完成这项工作的好工具。
我的代码:
url <-"https://letterboxd.com/crew/list/most-fans-on-letterboxd-with-pronoun-she/"
title <- read_html(url) %>%
html_nodes("span .frame-title") %>% # selector
html_text()
哪个应该给我与给定节点关联的标题(使用示例:电影Her (2013))...
<span class="frame-title" data-reactid=".c.3.1">Her (2013)</span>
...但是我每次和每个插槽都得到空白(“”)输出。
我正在考虑使用RCurl 软件包,但我不知道它是否真的有助于我提取节点的情况。我需要这个部门的一些帮助来获取这个网页的“框架标题”下的标题。任何帮助将不胜感激。
【问题讨论】:
标签: r web-scraping rvest httr