【发布时间】:2019-03-12 03:21:41
【问题描述】:
我正在使用selenium 登录一个页面,并下载一些 tiff 文件,
现在我有一个变量downloadurl,它包含我从网站上抓取的一组 url 链接。现在我正在使用以下代码下载文件:
driver = webdriver.Chrome();
driver.get(downloadurl)
我确实下载了所有文件但没有名称,例如。图像(1),图像(2) ...
现在我的问题是:我想driver.get(downloadurl)按照downloadurl的数组顺序一个一个下载文件,下载后马上按照数组的title变量重命名文件,然后下载下一个文件,然后重命名...
P.S.我避免使用请求,因为登录过程非常复杂并且需要授权cookie。
非常感谢您的帮助!
【问题讨论】:
-
如果您知道它最初会保存为
img(1),只需让您的脚本下载文件,然后将os.rename()文件从“img(1)”保存到其他文件。然后冲洗并重复,因为它们都将使用相同的名称下载。 docs.python.org/3/library/os.html#os.rename
标签: python selenium web-scraping beautifulsoup python-requests