【发布时间】:2013-10-31 21:40:37
【问题描述】:
我目前正在学习正则表达式,我正在尝试使用 notepad++ 从文档中过滤所有链接(例如:http://www.link.com/folder/file.html)。实际上我想删除所有其他内容,以便最后只列出 http 链接。
到目前为止我试过这个:http\:\/\/www\.[a-zA-Z0-9\.\/\-]+
这给了我所有找到的链接,但是我如何删除剩余的东西,以便最后我有一个所有链接的整洁列表?
如果我尝试用 \1 之后的任何内容替换它,显然链接将被删除,但我希望完全相反,删除所有其他内容。
所以它应该是这样的: - 找到一串数字、字母和特殊符号,直到“http” - 删除你发现的 - 并在“html”之后继续搜索更多的数字、字母和特殊符号 - 并再次删除它
有什么想法吗?非常感谢。
【问题讨论】:
-
将链接复制到另一个文件怎么样?
-
我能够用纯正则表达式提出的最佳解决方案是将每个链接隔离到自己的行上,尽管它也将字符串的结尾(例如:链接后的任何文本放在末尾一行)在自己的行上。
-
你会怎么做?