【发布时间】:2010-10-29 17:41:55
【问题描述】:
我想使用 python 正则表达式匹配 html 中每个段落中的内容。这些段落中总是有 BR 标记,如下所示:
<p class="thisClass">this is nice <br /><br /> isn't it?</p>
我目前正在使用这种模式:
pattern = re.compile('<p class=\"thisClass\">(.*?)<\/p>')
然后我正在使用:
pattern.findall(html)
查找所有匹配项。但是,它只匹配我拥有的 28 个段落中的两个,看起来那是因为这两个段落中没有 BR 标签,而其余的则有。我究竟做错了什么?我能做些什么来修复它?谢谢!
【问题讨论】: