【发布时间】:2019-03-04 14:45:43
【问题描述】:
我正在做一个爬虫项目,其中一个目标是从网站的 HTML 和 CSS 中获取每个图像链接。我使用 BeautifulSoup 和 TinyCSS 来做到这一点,但现在我想在 Selenium 上切换所有内容,因为我可以加载 JS。
我无法在文档中找到一种无需知道标签/id/类即可定位某些 CSS 参数的方法。我可以轻松地从 HTML 中获取图像,但我需要针对 CSS 中的每个“背景图像”参数,以便从中获取 URL。
例如:背景图片:url("paper.gif");
有没有办法做到这一点,或者我应该循环进入每个元素并检查相应的 CSS(这会很耗时)?
【问题讨论】:
-
"从 HTML 和 CSS 中获取每张图片..."从 CSS 中获取图片 是什么意思?你的预期结果是什么?您需要获取图片链接文件吗?
-
抱歉,我刚刚编辑了问题,我只需要网站上每张图片的链接,而不仅仅是 HTML 标签“img”中的链接
标签: python css selenium web-scraping selenium-chromedriver