【发布时间】:2017-12-01 00:00:26
【问题描述】:
我有一个这样的网址
http://foo.com/bar_by_baz.html
现在我想使用正则表达式从该 URL 中提取 baz。但到目前为止我只写了这么多
[_]+?\w[^.]+
这是给我的
_by_baz
作为输出。现在我想知道如何才能准确地选择任何特殊字符一次,或者使用正则表达式解决此问题的最佳方法是什么?
我正在 python 3.x 上尝试它
【问题讨论】:
-
也许有像
([^\/_]+)\.html这样的捕获组?或前瞻:[^\/_]+(?=\.html)? -
请说明您的环境是什么,正则表达式风格是什么,是否支持环视 - 您在做什么以及为什么不使用
parse_url之类的函数/方法?
标签: python regex python-3.x