【发布时间】:2014-11-08 13:49:49
【问题描述】:
我正在尝试收集页面上所有标签内的所有链接,并为 125 个页面执行此操作。我创建了以下循环,但它没有获取任何链接,但也没有给我任何错误消息。
for i in xrange(125,1,-1):
page = urllib2.urlopen("http://www.freedomworks.org/issue/budget-spending?page={}".format(i))
soup = BeautifulSoup(page.read())
snippet = soup.find_all('h3')
with io.open('FWurl.txt', 'a', encoding='utf8') as logfile:
for link in snippet.find_all('a'):
fulllink = link.get('href')
logfile.write(fulllink + "\n")
我认为这正是 BeautifulSoup 的用途,但我想不通。提前谢谢你。
【问题讨论】:
标签: python web-scraping beautifulsoup