【发布时间】:2019-07-31 14:06:00
【问题描述】:
我有 1000 个这样的文件:
text1.txt
<span class="store-time">OPEN SINCE <em>Aug 9, 2010</em></span>
text2.txt
<span class="store-time">OPEN SINCE <em>Aug 9, 2012</em></span>
我想从 1000 个文件中提取所有日期,每个文件都在新行中,如下所示:
Aug 9, 2010
Aug 9, 2012
...
【问题讨论】:
-
首先选择合适的工具。我建议使用 XML/HTML 解析器(例如 xmlstarlet)。
-
怎么样!你能给我举个例子吗
-
xmlstarlet select --template --copy-of '//span/em/text()' -n text*.txt