【发布时间】:2018-10-16 01:54:39
【问题描述】:
我正在尝试从这个 XML 文件的标签中提取数字:
<start-date type="date">1980-12-12</start-date>
<end-date type="date">2018-05-04</end-date>
<data type="array">
<datum type="array">
<datum type="date">2018-05-04</datum>
<datum type="float">178.25</datum>
<datum type="float">184.25</datum>
<datum type="float">178.17</datum>
<datum type="float">183.83</datum>
<datum type="float">56201317.0</datum>
<datum type="float">0.0</datum>
<datum type="float">1.0</datum>
<datum type="float">178.25</datum>
<datum type="float">184.25</datum>
<datum type="float">178.17</datum>
<datum type="float">183.83</datum>
<datum type="float">56201317.0</datum>
</datum>
使用这个脚本:
#Test Parser
from xml.dom import minidom
xmldoc = minidom.parse('AAPL.xml')
itemlist = xmldoc.getElementsByTagName('datum')
print(len(itemlist))
print(itemlist[0].attributes['type'].value)
for s in itemlist:
print(s.attributes['type'].value)
但是输出返回什么类型是 = to 所以它会一遍又一遍地返回浮点数、数组和日期,但我需要标签数据中的数字 像这样:
<datum type="float">178.25</datum>
我需要 178.25 的值 我怎样才能改变我的脚本来做到这一点 这是我的第一个解析器项目,所以我有点迷路了。任何帮助表示赞赏
【问题讨论】:
标签: python python-3.x parsing xml-parsing minidom