【发布时间】:2023-03-14 11:20:02
【问题描述】:
我正在尝试使用 BS4 进行一些网页抓取。
到目前为止,我已经提取了 <a> 使用
urls = [item for item in soup.select('h4 a')]
但是,我只想知道 ID 从哪个条目开始的 url。
<a href="http://www.sampleurl.com/static/welcome" id="entry_1">Lamborghini </a>
我尝试过item.id,但它不起作用。
我错过了什么?
【问题讨论】:
-
item.get('id')? -
是的,如果条件是“ID 开始 with 'entry'”
urls = [item for item in soup.select('h4 a') if item.get("id", "")[:6] == "entry_"]
标签: python beautifulsoup