【发布时间】:2019-11-09 01:21:52
【问题描述】:
我正在尝试抓取一个网站及其工作,但我想限制出现的结果数量。我该怎么做?
req = requests.get('https://www.imdb.com/list/ls026573448/')
soup2 = bs4.BeautifulSoup(req.text,)
def pressed(self, instance):
genre = self.genre.text
if genre == 'Horror' or 'horror':
soup2.select('h3')
for x in soup2.select('h3'):
print(x.text)
当我运行这段代码时,会出现大约 50 个结果。我如何将其限制为 20 或 15 个?
【问题讨论】:
-
您要过滤结果吗?如果是,过滤器的标准是什么?
-
不,我不想过滤任何东西@AndrejKesely,我只想获得前 20 个结果,而不是所有结果
-
因此,当您的结果在变量
results(即列表)中时,例如对于前 20 个结果,您可以执行results[:20] -
for i , tag in enumerate(soup2.select('h3')): if (i > 25): break else: print(tag.text)
标签: python parsing web-scraping screen-scraping