【发布时间】:2016-12-30 21:18:16
【问题描述】:
我有如下数据,
数据
url
http://hostname.com/part1/part2/part3/a+b+c+d
http://m.hostname.com/part3.html?nk!e+f+g+h&_junk
http://hostname.com/as/ck$st=f+g+h+k+i/
http://www.hostname.com/p-l-k?wod=q+w+e+r+t africa
我想检查 url 中的第一个 + 符号并向后移动,直到找到特殊字符,例如 / 或 ?或 = 或任何其他特殊字符,然后从该字符开始,直到找到空格或行尾或 & 或 /。我的输出应该是,
parsed
abcd
efgh
fghki
qwert
我的目标是在 URL 中找到第一个 +,然后返回直到找到特殊字符,然后返回到前面,直到找到行尾或空格或 & 符号。
我是正则表达式的新手,还在学习它,因为它有点复杂,我发现很难写。任何人都可以帮助我在 python 中编写一个正则表达式来解析这些吗?
谢谢
【问题讨论】:
标签: python regex python-2.7 python-3.x pyspark