【发布时间】:2015-01-20 02:56:06
【问题描述】:
我使用lxml 从 html 页面中检索标签的属性。 html页面的格式如下:
<div class="my_div">
<a href="/foobar">
<img src="my_img.png">
</a>
</div>
我用来检索<a>标签内的url和同一<img>标签内src值的python脚本是这样的:
from lxml import html
...
tree = html.fromstring(page.text)
for element in tree.xpath('//div[contains(@class, "my_div")]//a'):
href = element.xpath('/@href')
src = element.xpath('//img/@src')
为什么我没有得到字符串?
【问题讨论】: