【发布时间】:2021-12-05 08:43:08
【问题描述】:
我对抓取网页非常陌生。我有一个ali express page 的网址。当我尝试通过以下简单步骤进行抓取时
url = https://www.aliexpress.com/item/4000275547643.html
page = Nokogiri.HTML(open(url))
当我尝试获取产品的详细信息时,它返回 nil
product = page.at(".product-info")#returns nil
谁能帮我解决解析整页需要做的事情。
【问题讨论】:
-
open(url)返回什么?预期的 HTML 内容?或者可能是错误页面或重定向? -
看看nokogiri.org/#parsing-and-querying 。你应该使用 URI.open 。