【发布时间】:2017-10-02 23:53:25
【问题描述】:
如何删除文本中包含PATTERN 的元素(从<span> 到</span>)?元素的内容应该随着元素一起被删除。
例如我想删除下面的第一个<span>...</span>元素:
<span><SPAN>some text with
with </SPAN> a PATTERNin it etc</span><span><SPAN>some text
without </SPAN> a thingIn it etc</span>
仅使用 SED 进行生产:
<span><SPAN>some text
without </SPAN> a thingIn it etc</span>
PS:对行尾或单字没有帮助,它只能检测到任何<span>...</span> 和PATTERN。
生产服务器只允许使用 SED 等基本命令。 我目前正在使用以下方法,但它很丑而且似乎不起作用。
sed '/<span.*\n.*PATTERN.*<\/span>/d'
【问题讨论】:
-
什么是“应答器”?期望的输出应该是什么样的?
-
您的描述不清楚。这一切是什么意思?
-
你尝试了什么?展示你的努力并发送minimal reproducible example。
-
增加了清晰度、结果和进度
-
可惜。如果它是 XHTML(以显示它是多么愚蠢),可能会尝试编写一个基于 sed 的解析器来获得乐趣,但是 HTML 要复杂得多,你说你甚至没有 HTML?那么,您希望我们如何解析它??