【发布时间】:2021-04-15 10:29:45
【问题描述】:
我有一个格式如下的网站:
<html lang="en">
<head>
#anything
</head>
<body>
<div id="div1">
<div id="div2">
<div class="class1">
#something
</div>
<div class="class2">
#something
</div>
<div class="class3">
<div class="sub-class1">
<div id="statHolder">
<div class="Class 1 of 15">
"Name"
<b>Bob</b>
</div>
<div class="Class 2 of 15">
"Age"
<b>24</b>
</div>
# Here are 15 of these kinds
</div>
</div>
</div>
</div>
</div>
</body>
</html>
我想检索这 15 个类中的所有内容。我该怎么做?
编辑: 我目前的做法:
import requests
from bs4 import BeautifulSoup
url = 'my-url-here'
response = requests.get(url)
soup = BeautifulSoup(response.content, "html.parser")
name_box = soup.findAll('div', {"id": "div1"}) #I dont know what to do after this
预期输出:
Name: Bob
Age: 24
#All 15 entries like this
我为此使用 BeautifulSoup4。
有什么直接的方法可以获取<div id="stats">中的所有内容吗?
【问题讨论】:
-
您当前的代码/方法是什么?您寻求的预期输出究竟是什么?
-
@costaparas 问题已编辑 :)
标签: html python-3.x web-scraping beautifulsoup python-3.8