【发布时间】:2013-05-25 17:59:37
【问题描述】:
我目前正在抓取一个包含多个链接级别的网站,并且似乎 mechanize 无法处理嵌套链接。例如,假设我有:
br = mechanize.Browser()
response = br.open('some_site');
for link in br.links():
br.follow_link(link)
for link in br.links():
br.follow_link(link)
一旦 mechanize 退出内循环,它就会停在那里,而不会循环通过外循环的链接。
我尝试了 br.back() 但它也不起作用。有解决方法还是我做错了什么?谢谢。
【问题讨论】:
-
只是一个建议:尝试请求 (docs.python-requests.org/en/latest) 会让您的生活更轻松