【发布时间】:2015-02-04 13:49:46
【问题描述】:
这个问题听起来很简单,但我在解决它时遇到了困难。我有一个如下表:
<table><tbody>
<tr>
<td>2003</td>
<td><span class="positive">1.19</span> </td>
<td><span class="negative">-0.48</span> </td>
</tr>
我的代码如下:
from lxml import etree
for elem in tree.xpath('//*[@id="printcontent"]/div[8]/div/table/tbody/tr'):
for c in elem.xpath("//td"):
if(c.getchildren()): # for the <span> thing
text = c.xpath("//span/text()")
else:
text = c.text
但我无法遍历“td”元素。我一直在尝试这一天,但无济于事!我想得到 2003。1.19 和 -0.48。
请帮忙!
【问题讨论】:
标签: python web-scraping lxml