【发布时间】:2014-06-24 17:41:58
【问题描述】:
我有一个在 XML 标记中包含 HTML 的文件,我希望该 HTML 作为原始文本,而不是让它被解析为 XML 标记的子级。这是一个例子:
import xml.etree.ElementTree as ET
root = ET.fromstring("<root><text><p>This is some text that I want to read</p></text></root>")
如果我尝试:
root.find('text').text
不返回任何输出
但是 root.find('text/p').text 将返回没有标签的段落文本。我希望文本标签中的所有内容都是原始文本,但我不知道如何获得它。
【问题讨论】:
标签: html xml python-3.x xml-parsing elementtree