【发布时间】:2020-05-08 09:01:45
【问题描述】:
简单的正则表达式任务:在字符串中查找 ID(和语言)。
import re
txt = '<OB02 ID="1099367" LANG="FR">'
pattern = r'\\ID="(.*?)\\"'
result = re.findall(pattern, txt)
这会给出一个空列表作为结果。引出问题:
- 如何在python中正确封装\"?
- 如何从txt中提取ID和LANG?
【问题讨论】:
简单的正则表达式任务:在字符串中查找 ID(和语言)。
import re
txt = '<OB02 ID="1099367" LANG="FR">'
pattern = r'\\ID="(.*?)\\"'
result = re.findall(pattern, txt)
这会给出一个空列表作为结果。引出问题:
【问题讨论】:
作为一种解决方法,您可以使用以下正则表达式:
import re
txt = '<OB02 ID="1099367" LANG="FR">'
pattern = 'ID="([^"]*)'
result = re.findall(pattern, txt)
如前所述,这是一个坏主意,因为如果有人现在开始使用单引号或添加 cmets,这将中断。
【讨论】: