【发布时间】:2020-04-05 11:59:00
【问题描述】:
我有一个抓取网站的脚本。但是,我正在寻找它来逐步抓取网站的范围。所以想象范围设置为 0-999。代码是:
import requests
from bs4 import BeautifulSoup
URL = 'https://www.greekrank.com/uni/1/sororities/'
page = requests.get(URL)
soup = BeautifulSoup(page.content, 'html.parser')
uni = soup.find_all('h1', class_='overviewhead')
for title in uni:
print(title.text)
rows = soup.find_all('div', class_='desktop-view')
for row in rows:
print(row.text)
它会去https://www.greekrank.com/uni/1/sororities/刮那个,然后去https://www.greekrank.com/uni/2/sororities/刮那个,等等。
【问题讨论】:
-
好吧,写一个
for循环?你已经写了两个,所以你应该知道怎么做。
标签: python web-scraping