【发布时间】:2023-03-28 08:24:01
【问题描述】:
我正在尝试从网站下载多个压缩文件。我查看了下载一个文件的答案,看起来很简单,但我无法让它适用于多个文件。该网址有超过 140 个我想下载的压缩文件。
到目前为止,我的代码想法是:
import urllib
url = "http://ftp.geogratis.gc.ca/pub/nrcan_rncan/vector/geobase_nhn_rhn/shp_en/03/"
##search url for zipped files and download them (this is where I am stuck)
urlfile = (the zipped files??)
if urlfile.endswith (".zip"):
urllib.urlretrieve (url, r"C:\Users\maverick\Desktop\Canada Features")
我知道它甚至还没有接近我需要的东西,但是如果朝着正确的方向前进,我们将不胜感激。我也看过Scrapy,但我认为urllib应该能够完成任务。
【问题讨论】:
-
您可以通过ftp 连接以传输您的文件吗?如果您专注于解析网页,那么Beautiful Soup 可能对您有用。