【发布时间】:2020-11-09 21:16:24
【问题描述】:
我正在尝试抓取这个网站
https://www.neds.com.au/sports/esports
我正在使用 scrapy 来执行此操作,但我所做的任何尝试都只会抓取预加载器页面。我只是使用了错误的工具吗?
【问题讨论】:
-
这就是他们有预加载器页面的原因;)像scrapy这样的库通常不执行任何javascript,因此不会加载任何内容,这意味着您只需获取预加载器页面的原始html
-
根据 Luke 的说法,您需要使用 splash-scrapy 或 selenium scrapy 来执行此操作。
-
感谢您的回复,非常感谢。
标签: python web beautifulsoup scrapy screen-scraping