【发布时间】:2020-07-18 13:56:22
【问题描述】:
我想获取所有 p 标签并将其存储在一个列表中,但不幸的是它们之间都有一个
。
内容如下所示:
<p>Ich halt mir die Pistole an den Kopf
<br/>Doch drück' nicht ab, denn ich hab zu viel Angst vor Gott</p>,
<p>Feinde wurden zu Brüdern
<br/>Und Brüder wurden zu V-Männern
<br/>Die beste Gang, in der ich jemals war
<br/>Me, myself und meine DNA</p>,
我应该看起来像:
[Ich halt mir die Pistole an den Kopf
Doch drück' nicht ab, denn ich hab zu viel Angst vor Gott, Feinde wurden zu Brüdern
Und Brüder wurden zu V-Männern
Die beste Gang, in der ich jemals war
Me, myself und meine DNA,]
这是我当前的代码:
url = requests.get("https://www.myzitate.de/suche/farid-bang/")
z = bs(url.content)
cont = z.find("div", attrs={"id":"cont"})
cont.find_all("p")
【问题讨论】:
-
xKuramaa,作为 myzitate.de 的网站管理员,我觉得你为什么要从我的页面上抓取内容很有趣?
标签: python web-scraping beautifulsoup