【发布时间】:2023-03-18 11:37:01
【问题描述】:
我想在一个大的 html 文本中获取某个 html 节点,但是我的正则表达式中的某些内容是错误的。
我想获取所有如下所示的网址:
<a href="ftp://mysite.com"> some stuff </a>
我正在努力:
/<a href="ftp:(.+)">/
但有时它会起作用,但有时它会抓住一切,直到下一次关闭>。
有没有办法重写这个正则表达式,让它在第一个 > 处停止?
【问题讨论】:
-
+天生贪婪。您需要通过在+之后添加?限定符来使其不贪婪。所以你的正则表达式是<a href="ftp:(.+?)"> -
如果您希望它匹配直到
"的所有内容,请使用[^"]*,而不是.+。
标签: regex regex-greedy