【发布时间】:2018-03-20 21:37:56
【问题描述】:
我正在抓取网页传单
https://flipp.com/flyers/groceries
POSTAL CODE N2L2A1
然而,尽管所有项目都用 HTML 编码,具有相同的标签和类名,但我无法在 selenium 中抓取所有内容。
我尝试了 find_elements 方法,但仍然只能抓取一个值,从概念上讲不应该是这样。
因为我使用的是通用类名,所以应该列出所有内容。
这里不是这样。我错过了什么吗?
我的代码如下所示:
driver.find_elements_by_xpath("//html/body/flipp-dialog/div/flipp-toast-container/div/flipp-item-dialog/div/h2/span")
【问题讨论】:
-
我的想法是......看起来每张图片都是一个可点击的标签,所有这些可点击的标签链接都在一个页面中给出,也就是上面的链接。
-
该链接对我不起作用 - 404 uh oh 意外错误
-
嗨,马丁,感谢您的尝试。你可以试试这个flipp.com/flyers/groceries
标签: python selenium web-scraping selenium-chromedriver