【发布时间】:2020-09-07 17:20:12
【问题描述】:
我正在尝试使用 requests 模块从 webpage 中抓取所有图片链接。当我使用此链接时,我只能向上抓取图像链接,直到向下滚动时显示的其余内容。但是,如果我使用这个link,我可以通过增加附加到链接的最后一个数字来获取所有图像 ID。问题是我不能重用这些 id 来制作完整的图片链接。
我试过了:
import requests
from bs4 import BeautifulSoup
url = 'https://stocksnap.io/api/search-photos/phone/relevance/desc/1'
with requests.Session() as s:
s.headers['User-Agent'] = 'Mozilla/5.0 (Windows NT 6.1) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/85.0.4183.83 Safari/537.36'
r = s.get(url)
for item in r.json()['results']:
print(item['img_id'])
如何从该网站的登录页面获取所有图片链接?
PS 前几个赞助图片链接应该被忽略,因为它们也不包含在 api 中。
【问题讨论】:
标签: python python-3.x web-scraping python-requests