【发布时间】:2016-06-01 11:38:46
【问题描述】:
我有一个 XML 文件,其中包含许多帐户标签,其中将包含很少的其他标签,包括 RecordNumber 和 OriginalData。我想比较该 XML 文件中的 2 个数字,一个来自 RecordNumber 标签,另一个来自 OriginalData——part_name 后正好是 6 个字符。理想情况下,这 2 个数字应该相等,但在某些 xml 标签的某些文件中它们是不同的。
使用 awk 或 sed 会很棒???
这是我的 XML 文件的示例。
....
<Account>
.......
<RecordNumber>224</RecordNumber>
......
<OriginalData><![CDATA[E0000003350000077558part_name 89947 0123456789012345 C2016-01-08T13:04:41-05:00001004000000000000000035.000000000000000000035.000 US034F93Geg824G36L8F 0002
.....
……
感谢您的帮助。
【问题讨论】:
-
224 RecordNumber> 帐户> -
对不起,这是我第一次添加代码,所以无法清楚地添加,抱歉格式不好。
-
尝试先发布您已经完成的代码。阅读stackoverflow.com/help/formatting 以了解您的问题的格式,并阅读stackoverflow.com/help/mcve 以了解如何提问。
-
我在这里有另一个建议:不要使用 sed/awk 处理 xml 文件,尝试使用 xml 库作为您最喜欢的编程语言(如果您有大量数据则使用流式传输)或使用 xml 处理工具像 xmlstartlet。
-
那是 xmlstarlet。 (这有点令人吃惊。)