【发布时间】:2014-01-07 15:26:46
【问题描述】:
我正在尝试使用以下代码抓取页面。当我运行代码时,我在第一次分配给titles 变量时遇到错误。错误是:AttributeError: 'NonType' object has no attribute 'split'。
如果我只是用 print(tag.text) 替换分配,它会按预期工作。对 commmands 变量的第二次赋值也按预期工作。为什么第一个作业会产生错误?
代码:
import requests
import lxml.html as LH
s = requests.Session()
r = s.get('http://www.rebootuser.com/?page_id=1721')
root = LH.fromstring(r.text)
def getTags():
commands = []
titles = []
for tag in root.xpath('//*/tr/td[@width="54%"]/span'):
titles += tag.text.split(',')
for tag in root.xpath('//*/td/span/code'):
commands += tag.text.split(',')
zipped = zip(titles, commands)
for item in zipped:
print item
getTags()
【问题讨论】: