【发布时间】:2013-04-17 21:28:16
【问题描述】:
我有这段代码,它从网页中读取链接(URL)并将它们打印在屏幕上。
connection = urllib.urlopen("http://www.google.com")
dom = lxml.html.fromstring(connection.read())
for link in dom.xpath('//a/@href'):
print link
它工作正常。
现在我想做完全相同的事情,但是代替锚标签a中的url,我想获取src下img的HTML标签中的图像的url。我无法理解这个dom.xpath('//a/@href') 是如何工作的。如果有人可以解释它或只是指导我学习教程,那就太好了。
干杯
【问题讨论】: