【问题标题】:Web scraping prices from an aggregator sites从聚合网站抓取价格
【发布时间】:2016-02-19 08:50:54
【问题描述】:

这对某些人来说可能非常简单。但我无法理解它。我正在尝试从网站中提取价格和其他信息。

Link

我正在使用 Rvest 进行抓取。我不是来自 CS 背景,所以我无法理解将使用的 html 节点的类输入。我正在“类似酒店”部分寻找类似酒店的价格。我的代码尝试如下。请让我知道我的代码中的缺点。

    url='http://www.yatra.com/hotels/hotels-in-coorg/club-mahindra-madikeri-coorg'
    
index <- url %>%
    read_html() %>%
    html_nodes("#carousel_one")

count <- index %>%
    html_nodes("span") %>%
    html_text() %>% 

location <- counts %>%
    html_nodes("p") %>%
    html_text()

type <- counts %>%
    html_nodes("a") %>%
    html_text()

我有一个转机,但它是针对单个节点的。我想在一个命令中获取所有节点。

我的代码显然不正确。理想情况下,我正在寻求有关为此类信息找到正确标签和类所涉及的方法的解释。

我已经阅读了 TNC 条件。

【问题讨论】:

  • 在我看来您正在尝试抓取业务目录,然后阅读this
  • @IgorSavinkin 会读到,但我解决了这个问题。

标签: r web-scraping rvest


【解决方案1】:

我可以得到代码,但又缺少一点逻辑。

代码是:

index <- url %>%
    read_html() %>%
    html_nodes("#container .crousel")

fetch <- index %>%
    html_nodes("span") %>%
    html_text()

【讨论】:

    猜你喜欢
    • 2022-01-08
    • 2020-03-10
    • 1970-01-01
    • 2022-07-21
    • 1970-01-01
    • 2021-07-01
    • 2019-01-16
    • 1970-01-01
    • 2017-10-16
    相关资源
    最近更新 更多