【发布时间】:2021-04-22 01:16:46
【问题描述】:
我正在写一篇尝试从以下网站抓取一些数据:
http://www.b3.com.br/pt_br/market-data-e-indices/servicos-de-dados/market-data/historico/renda-fixa/
它按预期工作了一段时间,但现在它在第 3 行加载页面时卡住了。
url = 'http://www.b3.com.br/pt_br/market-data-e-indices/servicos-de-dados/market-data/historico/renda-fixa/'
driver = webdriver.Chrome()
driver.get(url)
奇怪的是页面实际上已完全加载,因为我可以毫无问题地浏览它,但 chrome 一直在底部向我显示“正在连接...”消息。
当 selenium 最终放弃并引发 TimeoutException 时,“正在连接...”消息消失,Chrome 知道该页面实际上已完全加载。
如果我尝试在另一个选项卡中手动打开链接,它会在不到一秒的时间内完成。
有没有一种方法可以覆盖内置的“等待加载”并进入下一步,因为我需要的所有内容都已加载?
【问题讨论】:
-
这不是硒问题 - 该网站很奇怪。即使在手动测试中,它也会永远加载。
-
网站有问题。页面永远加载。
标签: python selenium google-chrome loading