【发布时间】:2018-11-05 06:30:53
【问题描述】:
我正在使用正则表达式从 python 中的文本中提取首字母缩写词(仅限特定类型)。
- ABC(圆括号或方括号内或词尾之间的所有大写字母)
- A.B.C(同上,但中间只有一个“.”)
- A&B&C(同上,但中间只有一个“&”)
到目前为止我正在使用
text = "My name is STEVE. My friend works at (I.A.). Indian Army(IA). B&W also B&&W Also I...A"
re.findall('\\b[A-Z][A-Z.&]{2,7}\\b', text)
Output is : ['STEVE', 'I.A', 'B&W', 'B&&W', 'I...A']
I want to exclude B&&W and I..A, but include (IA).
我知道以下链接,但我无法正确使用它们。请帮忙。
Extract acronyms patterns from string using regex
【问题讨论】:
标签: regex python-3.x