【发布时间】:2017-12-13 22:23:25
【问题描述】:
我在 python 中编写了一些代码来从网页下载文件。由于我不知道如何从任何站点下载文件,所以我只能从该站点抓取文件链接。如果有人可以帮助我实现这一目标,我将非常感谢他。提前非常感谢。
链接到该网站:web_link
这是我的尝试:
from bs4 import BeautifulSoup
import requests
response = requests.get("http://usda.mannlib.cornell.edu/MannUsda/viewDocumentInfo.do?documentID=1194")
soup = BeautifulSoup(response.text,"lxml")
for item in soup.select("#latest a"):
print(item['href'])
在执行时,上述脚本会为这些文件生成四个不同的 url。
【问题讨论】:
标签: python python-3.x web-scraping download