【发布时间】:2023-03-10 11:35:02
【问题描述】:
我正在使用 mechanize 和 beautifulsoup 创建一个 python 脚本来从网页中提取一些数据。抓取工作正常,但我遇到的问题是移动到多个页面。有没有办法在循环中机械化页面之间移动?
这是我尝试过的
Browser().follow_link(text_regex="Next")
但它会转到下一页,这很好,但如果“下一步”按钮不存在,它就会死掉。我不确定如何制作一个更好的循环,或者在运行上面的跟随链接命令之前检查链接是否存在。
我发现的大多数示例和文档似乎只适用于一页。
【问题讨论】:
-
您可能希望发布更多您的代码,很难仅在一行上发表评论.. :)
-
@sarnold:你是不是故意留下
Broswer的错字? -
@phooji,感谢您指出。我几乎不可能发现字符换位错字,我认为下划线来自括号。 :)
-
@sarnold:感谢您的修复。我不确定您是否将“尊重原始问题”带到了一个新的极端;)
标签: python beautifulsoup mechanize web-scraping