【发布时间】:2015-09-09 08:23:21
【问题描述】:
我正在使用 BeautifulSoup 来轻松抓取。
我发现网页中有超过 5 个 div 我想废弃。他们的名字不同,但有规律。
这些 div 是:
divnewthing
divnew
divnewstring
等
所以模式是divnew* 一种正则表达式。
我正在使用:
soup.find('div', {"class": "divnew"})
目前。
我想以某种方式使用正则表达式。有谁能帮帮我吗?
【问题讨论】:
标签: python html regex beautifulsoup html-parsing