【发布时间】:2015-03-22 23:17:52
【问题描述】:
我正在尝试在 Linux (Debian) 中编写 bash 脚本,该脚本将用于从用户在启动期间提供的网站下载图形文件。我不确定我的代码是否正确,但第一个问题是当我尝试使用网站运行我的脚本时,例如http://www.bbc.com/ 显示错误:http://www.bbc.com/ : invalid identifier。我什至尝试了一个只有几个 JPG 文件的简单网站。我的下一个问题是找出如何从包含图片互联网地址的 .txt 文件中下载文件。
#!/bin/bash
# $1 - URL $2 - new catalog name
read $1 $2
url=$1
fold=$2
mkdir -p $fold
if [$# -ne 3];
then
echo "Wrong command"
exit -1
fi
curl $url | grep -o -e "<img src=\".*\"+>" > img_list.txt |wc -l img_list.txt | lin=${% *}
baseurl=$(echo $url | grep -o "https?://[a-z.]*"")
curl -s $url | egrep -o "<img src\=[^>]*>" | sed 's/<img src=\"\([^"]*\).*/\1/.*/\1/g' > url_list.txt
sed -i "s|^/|$baseurl/|" url_list.txt
cd $fold;
接下来我能做什么?
【问题讨论】:
-
您尝试其他链接了吗?
-
是的,我做到了,即使是一个只有几个 JPG 文件的简单网站。
标签: linux bash curl graphics download