【发布时间】:2019-06-09 08:41:14
【问题描述】:
我有以下问题,试图从 python 中的一堆 xml 文件中获取信息。我没有做任何特别的事情,例如:
import xml.etree.ElementTree as ET
root = ET.parse(r'C:\Documents\XMLfolder\file.xml').getroot()
info = root.find('foo').find('bar').find('info').text
这适用于我拥有的大部分信息 - 但 xml 的一部分采用以下格式:
<bar>
<info id="1"><label>1</label>SampleTextHere</info>
</bar>
上面的代码给出了None——不过,我可以找到info元素和label元素。我只是找不到文字。如果我编辑文件以删除<label> 1 </label>,那么上面的代码将返回我需要的文本。
是否有一些我不知道的非常基本的东西可以让我在不修改所有 xml 文件以删除标签的情况下访问文本? (这是相关的)。
谢谢!
【问题讨论】:
-
非常类似于stackoverflow.com/q/9673906/407651。 “SampleTextHere”是
<label>元素的tail。见docs.python.org/3/library/…。
标签: python xml python-3.x xml-parsing elementtree