1、 windows下安装wget
wget-1.11.4-1-setup.exe(访问密码:3678)
双击安装
2、系统环境Path变量添加C:\Program Files\GnuWin32
3、下载整站:
用wget下东西,非常方便,它会自动重连并断点续传。
经常要下载一个网站或网站的整个目录。
下载一个目录,例如下网站www.test.com/目录test下的所有文件
命令如下:
wget -r -p -k -np -nc -e robots=off http://www.test.com/test/
如果要想下载整个网站,最好去除-np参数。
wget -r -p -k -nc -e robots=off http://www.test.com/test/
具体参数可以–help查看,下面是一些常用选项
-r 递归;对于HTTP主机,wget首先下载URL指定的文件,然后(如果该文件是一个HTML文档的话)递归下载该文件所引用(超级连接)的所有文件(递 归深度由参数-l指定)。对FTP主机,该参数意味着要下载URL指定的目录中的所有文件,递归方法与HTTP主机类似。
-c 指定断点续传功能。实际上,wget默认具有断点续传功能,只有当你使用别的ftp工具下载了某一文件的一部分,并希望wget接着完成此工作的时候,才 需要指定此参数。
-nc 不下载已经存在的文件
-np 表示不追溯至父目录,不跟随链接,只下载指定目录及子目录里的东西;
-p 下载页面显示所需的所有文件。比如页面中包含了图片,但是图片并不在/yourdir目录中,而在/images目录下,有此参数,图片依然会被正常下 载。
-k 修复下载文件中的绝对连接为相对连接,这样方便本地阅读。
-o down.log 记录日记到down.log
-e robots=off 忽略robots.txt