【发布时间】:2021-12-05 02:23:47
【问题描述】:
我试图弄清楚如何从以下文章 HTML 属性中提取唯一的标题:
<a href="/wiki/Jammu_and_Kashmir_(union_territory)" title="Jammu and Kashmir (union territory)">Jammu and Kashmir< /a>
目前我可以使用以下方法提取所有整篇文章标签:
print(soup.find_all('a'))
但是如何只提取属性中的标题呢?
【问题讨论】:
-
页面上还有其他 HTML 吗?或者只有那个sn-p
-
页面上有更多 HTML,但结构相同,我只需要标题。
标签: beautifulsoup