【问题标题】:Price Scrape from an ecommerce website google sheets importxml从电子商务网站 google sheet importxml 刮取价格
【发布时间】:2020-11-24 23:08:28
【问题描述】:

您好,我需要从给定链接中获取价格,但我遇到了错误

xpath=IMPORTXML("https://www.tokopedia.com/jktmusicavenue/kawai-cn39-digital-piano-cn-39-cn-39-elektrik-yamaha-hitam","//*[@id="zeus-root"]/div/div[2]/div[1]/div/div[2]/div[4]/dd/h3")

【问题讨论】:

  • @JaSON 你能提供这个问题的解决方案吗?实际上这不是我的领域,我在另一个项目中遇到了这个。
  • 我认为您无法从该页面提取价格。源代码不包含该数据
  • @DonnyFlaw 实际上就在那里。可以提取自<h3 class="css-c820vl" data-testid="lblPDPDetailProductPrice">Rp19.500.000</h3>

标签: xpath web-scraping google-sheets


【解决方案1】:

尝试使用这个 XPath:

"//h3[@data-testid='lblPDPDetailProductPrice']"

附:另请注意,您正在使用双引号对而不在已被双引号对包围的 XPath 中转义

【讨论】:

  • 网页有问题,它没有响应任何请求。我试过写一个脚本,它适用于其他网站。
  • @AQIBABBAS 一切似乎都很好。我尝试使用 python-requests 并获得了所需的数据,但是! 请注意,您需要添加 User-agent header ,例如'User-Agent':'Mozilla/5.0 (X11; Ubuntu; Linux x86_64; rv:83.0) Gecko/20100101 Firefox/83.0'
猜你喜欢
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
  • 2016-03-31
  • 1970-01-01
  • 1970-01-01
  • 1970-01-01
相关资源
最近更新 更多