【发布时间】:2012-03-04 09:22:18
【问题描述】:
我是 Python 和一般编程的新手,所以如果问题很愚蠢,请原谅。
我一直在逐步关注this RSS 抓取教程,但在尝试收集指向正在收集的文章标题的相应链接时,我从 Python 收到“列表索引超出范围”错误。
这是我的代码:
from urllib import urlopen
from BeautifulSoup import BeautifulSoup
import re
source = urlopen('http://feeds.huffingtonpost.com/huffingtonpost/raw_feed').read()
title = re.compile('<title>(.*)</title>')
link = re.compile('<link>(.*)</link>')
find_title = re.findall(title, source)
find_link = re.findall(link, source)
literate = []
literate[:] = range(1, 16)
for i in literate:
print find_title[i]
print find_link[i]
当我只告诉它检索标题时它执行得很好,但是当我想检索标题和它们的相应链接时立即引发索引错误。
我们将不胜感激。
【问题讨论】:
标签: python regex rss screen-scraping