【发布时间】:2021-12-24 06:47:15
【问题描述】:
我正在尝试提取单词 SUITE、suite、ste、Ste 之后出现的任何内容。或熊猫数据框列中的字符#。示例如下
4230 Harding Pike Ste 435
4230 Harding Pike Suite 435
4230 Harding Pike SUITE A
4230 Harding Pike Ste. 101
4230 Harding Pike SUITE B-200
4230 Harding Pike #900
4230 Harding Pike STE 503
4230 Harding Pike SUITE 300
4230 Harding Pike Ste 700
4230 Harding Pike SUITE #2
结果:
SuiteNos
435
435
A
101
B-200
900
503
300
700
2
我尝试了以下正则表达式,但它没有按预期工作 -
df_merged['address'].str.extract(r'\**\**suite.*\**\**')
df_merged['address'] = re.findall('@([suite]+)', df_merged['address'])
【问题讨论】: