【发布时间】:2011-04-29 17:33:35
【问题描述】:
我正在使用以下代码来定位一个 div:
parser = etree.HTMLParser()
tree = etree.parse(StringIO(page), parser)
div = tree.xpath("//div[@class='content']")[0]
我唯一的问题是,在这样做之后我不想依赖 lxml 来提取所述 div 的内容:我只想取回 div 包含的原始 XML。这是可行的还是我必须完全放弃这种方法?
【问题讨论】:
标签: python xml html-parsing lxml