【发布时间】:2018-10-10 23:37:34
【问题描述】:
我在 Notepad++ 中打开一个 HTML 页面。
html页面有很多东西,尤其是这个标签:
<div id="issue_content">CONTENT</div>
我想从 html 文件中删除所有内容,除了 此标签及其内容:
<div id="issue_content">CONTENT</div>
文件示例:
<p>ewrfefsd</p>
<div id="issue_content">CONTENT</div>
<p>ewrfefsd</p>
</html>
删除后,文件内容应该是这样的:
<div id="issue_content">CONTENT</div>
我尝试使用正则表达式:
(<div id=\"issue_content\">)(.*?)(<\/div>)(.*?)
,
但是这个正则表达式只删除标签<div id="issue_content">CONTENT</div>和这个标签的内容
【问题讨论】:
-
为什么不创建一个包含该内容的新字符串,因为这就是您感兴趣的全部内容?您已经有了匹配值。
-
我需要删除 3000 个 html 文件中不必要的内容。DIFFERENT CONTENT标签中的内容不同