【发布时间】:2020-07-05 06:05:35
【问题描述】:
http://mediafile.cloud/e1b227799b1e3e3b
我正在尝试在python中使用urllib读取此页面,但它在60秒的时间延迟之前读取数据,我如何在时间延迟之后获取数据
from urllib.request import Request, urlopen
from bs4 import BeautifulSoup
import time
domain=Request("http://mediafile.cloud/e1b227799b1e3e3b")
domain.add_header('User-Agent', 'Mozilla/5.0')
response =urlopen(domain)
time.sleep(60)
html = response.read()
【问题讨论】:
-
使用 urllib 可能是可行的,但我想说当你想与网页进行交互时使用 selenium 会更合适。
-
您可能需要一个 python 模块来呈现 JavaScript 脚本 - 可能是
requests_html或selenium?
标签: python python-3.x web-scraping beautifulsoup urllib