【发布时间】:2012-01-22 06:44:30
【问题描述】:
我有一个 HTML 文件
...<b>Breakfast</b><hr>...
我想要Breakfast,它介于> 和< 之间。
我试过了
...for test_string in line:
if re.match(r'(>.*<$)',test_string):...
那也没有给>Breakfast<。
谢谢。
【问题讨论】:
-
为什么包含
$? -
你应该看看这样的东西:crummy.com/software/BeautifulSoup
-
像往常一样,涉及到 HTML 和正则表达式:stackoverflow.com/a/1732454/118068
标签: python regex xml-parsing