【发布时间】:2013-02-15 11:44:06
【问题描述】:
我需要从网页下载适合文件。我正在使用-i wget 选项执行此操作:我将下载文件存储在包含 URL1、URL2 的 list.txt 文件中......然后
$ wget -i list.txt
您知道是否有可能使用 Python 脚本来做同样的事情?
【问题讨论】:
我需要从网页下载适合文件。我正在使用-i wget 选项执行此操作:我将下载文件存储在包含 URL1、URL2 的 list.txt 文件中......然后
$ wget -i list.txt
您知道是否有可能使用 Python 脚本来做同样的事情?
【问题讨论】:
假设您的文件每行包含一个 URL,您可以这样做:
import urllib2
with open('list.txt') as my_list:
for line in my_list:
response = urllib2.urlopen(line)
html = response.read()
# now process the page's source
【讨论】:
如果您获得 SSL:CERTIFICATE_VERIFY_FAILED:
import wget
import ssl
ssl._create_default_https_context = ssl._create_unverified_context
with open('list.txt') as my_list:
for url in my_list:
wget.download(url)
使用操作系统库:
import os
with open('list.txt') as my_list:
for url in my_list:
os.system('wget ' + url)
【讨论】:
with open('list.txt') as my_list:
for url in my_list:
wget.download(url)
【讨论】: