【发布时间】:2011-04-27 13:50:35
【问题描述】:
我刚刚浏览完python DOM API,似乎找不到我要找的东西。
我基本上想在遍历 DOM 树时保留 XML 标签。这个想法是打印标签名称和相应的属性,我稍后想将它们转换为 xml 文件。
<book name="bookname" source="/home/phiri/Book/book.xml"
xmlns:xi="http://www.w3.org/2001/XInclude">
<chapter>
<page>page1</page>
<page>page2</page>
</chapter>
<chapter>
<page>page1</page>
<page>page2</page>
<page>Page3</page>
</chapter>
</book>
以上面的 XML 内容为例,我想要的是 book.xml 文件的结果。
<book name="bookname" source="/home/phiri/Book/book.xml"
xmlns:xi="http://www.w3.org/2001/XInclude">
<chapter></chapter>
<chapter></chapter>
</book>
是否有一个替代的 xml 包可以用来保存使用 python 提取内容时得到的结果?
【问题讨论】:
-
问题不是很清楚..听起来您想使用 XSLT(样式表转换)。如果您明确说明您正在尝试做什么,您将更有可能获得帮助。
-
@SteveMc:感谢您的回复。我基本上是在尝试将我的 XML 文档分解成更小的部分,每个部分只有两个级别。 Book.xml 将有书籍节点和章节节点 Chapter.xml 将有章节节点和页面节点 page.xml 将只有页码文本我希望这有助于澄清事情。
-
想法是最终使用 XInclude 重新组装完整的文档。