【发布时间】:2021-02-09 06:32:44
【问题描述】:
作为一个实践项目,我正在尝试从网站上抓取房产数据。 (我只打算练习我的网络抓取技巧,无意进一步利用抓取的数据)。但是我发现某些属性没有可用的价格,因此,当我尝试将它们组合到一个数据框时,这会产生不同长度的错误。
这里是抓取的代码:
library(tidyverse)
library(revest)
web_page <- read_html("https://wx.fang.anjuke.com/loupan/all/a1_p2/")
community_name <- web_page %>%
html_nodes(".items-name") %>%
html_text()
length(community_name)
listed_price <- web_page %>%
html_nodes(".price") %>%
html_text()
length(listed_price)
property_data <- data.frame(
name=community_name,
price=listed_price
)
当没有价值被刮掉时,我如何识别没有列出价格的房产并用 NA 填充价格变量?
【问题讨论】:
标签: r web-scraping rvest