首页 > 其他分享 >什么,你不知道wget可以这样用?

什么,你不知道wget可以这样用?

时间:2022-10-22 22:58:25浏览次数:82  
标签:zip -- 知道 这样 https wget example 下载

导读

本文将介绍wget的基本使用方法,和一些高级用法,比如递归下载等。对于经常在FTP网页下载数据的读者来说,可以说是必备的技能之一。

1. 介绍

Wget 是由 GNU 项目创建的计算机工具。您可以使用它从各种 Web 服务器检索内容和文件。这个名字是万维网和get这个词的组合。它支持通过FTP、SFTP、HTTP 和 HTTPS下载。

Wget 是用可移植的 C 语言创建的,可在任何 Unix 系统上使用。也可以在Mac OS X、Microsoft Windows、AmigaOS和其他流行平台上实现。

2. 安装

  • Ubuntu 18.04
sudo apt-get install wget
  • CentOS 7
sudo yum install wget

3. 命令

3.1. 单个文件

# 下载单个文件到当前文件夹
wget https://example.zip  # wget url

3.2. 多个文件

需要将多个件的url写到一个txt文件中,再利用wget下载

# example.txt
https://example1.zip

https://example2.zip

https://example3.zip
  • 下载上面example.txt文件中的文件
wget -i example.txt

3.3. 命名

  • 给下载文件重命名
wget -O example.zip https://ttt.zip  

# 利用-o 选项,重命名文件为`example.zip`

3.4. 指定目录

  • 将下载文件保存到指定目录
wget -P documents/archives/ https://example.zip

# 利用-p 选项,将文件保存到`documents/archives/`目录下

3.5. 限制下载速度

wget --limit-rate=500k https://example.zip

# 将下载速度最高限制为 500k

3.6. 重试尝试次数

wget -tries=100 https://example.zip

# 设置重新连接次数为100

3.7. 后台下载

当下载的文件非常大的时候,可以将下载任务放置到后台

wget -b https://example.zip

3.8. FTP下载

wget --ftp-user=YOUR_USERNAME --ftp-password=YOUR_PASSWORD ftp://example.com/something.tar
  • --ftp-user:FTP用户名
  • --ftp-password:密码

3.9. 断点续连

当再下载途中,链接中断时,可以使用-c选项,进行重新连接,继续上次下载。

wget -c https://example.zip

3.10. 检索全站

  • 下载整个网站的内容
wget --mirror --convert-links --page-requisites --no-parent -P documents/websites/ https://example.com
参数 作用
–mirror 递归下载
–convert-links 所有链接都将转换为正确的脱机使用
–page-requisites 下载将包括CSS、JS和图像
–no-parent 不检索父目录
-P 指定保存目录

3.11. 查找断开链接

  • 查找网页中无法下载的连接,并输出到文件中
wget -o wget-log -r -l 5 --spider http://example.com
参数 作用
-o 将输出收集到文件中供以后使用
-l 指定递归级别
-r 递归下载
–spider 将wget设置为spider模式
  • 利用下面命令,过滤出无法下载的文件
grep -B 2 '404' wget-log | grep "http" | cut -d " " -f 4 | sort -u

# wget-log是第一步的输出结果

3.12. 下载编号文件

如果文件名是按照数字编号时,可以同时下载。

wget http://example.com/images/{1..50}.jpg

本文由mdnice多平台发布

标签:zip,--,知道,这样,https,wget,example,下载
From: https://www.cnblogs.com/swindler/p/16817525.html

相关文章

  • 你知道贫血模型和充血模型是什么吗?
    前提Controller层提供接口层,用于让外部三方调用Service层用于做逻辑处理,组装不同业务需要的数据或者操作这些数据,BO是实体数据类也即操作的数据类Repository:数据存储层,比......
  • 噢!查重原来是这样实现的啊!
    前言项目中有一个查重的需求,就类似论文查重这种的需求,我的组长已经写好了这个Demo了,我也挺感兴趣的,所以也看了看是如何实现的,看完后,感慨一声,噢!原来是这样实现的啊!。现在......
  • 有人知道SASE是什么意思吗?企业为什么需要引进SASE解决方案?
    SASE就是安全访问服务边缘的意思,现在很多正在数字化转型的企业都需要接触到网络安全的问题,传统的安全架构已经无法满足企业的发展需求,而SASE则可以为他们提供一个全新的解决......
  • .net core 配置Swagger 摆脱PostMan,你值得拥有这样的api调试方式
    废话不多说直接来看第一步:安装nuget包:Swashbuckle.AspNetCore.Swagger            Swashbuckle.AspNetCore.SwaggerGen         ......
  • 表面粗糙度为什么用0.8, 1.6, 3.2?你知道吗?
    1粗糙度的概念零件经过加工后,由于刀具、积屑瘤和鳞刺等给工件表面造成或大或小的波峰与波谷。这些峰谷的高低程度很小,通常只有放大才能看见。这种微观几何形状特征,称......
  • 建设智能机房--动环监控系统你不知道的事
     现如今我们讲的动环监控系统可以简易看作机房动环、机房动力环境监控系统、动环监控;就是对各机房的动力、环境、安防进行集中监测。它不仅自动检测范围广,还有效的减少了......
  • wget --no-check-certificate 问题解决
    很多时候一些老旧机器因为ca证书的问题,造成下载异常,实际上解决方法很简单,一种方法是参考提示就行了解决方法添加--no-check-certificate使用.wgetrc文件(以后都就可......
  • 关于报出这样的错误:org.apache.catalina.core.StandardWrapperValve.invoke 在路径为/
    从23:30开始报错检查,现在才弄好,发出来分享一下错误界面:首先,我们需要检查一下我们利用DBUtil.java文件中引用的db文件名称是否正确,(我就是因为没有注意到文件名称是否正确......
  • 003.wget命令
    wget命令wget是一个下载文件的工具,它用在命令行下。对于Linux用户是必不可少的工具,尤其对于网络管理员,经常要下载一些软件或从远程服务器恢复备份到本地服务器。如果我......
  • C语言中这么骚的退出程序的方式你知道几个?
    C语言中这么骚的退出程序的方式你知道几个?前言在本篇文章当中主要给大家介绍C语言当中一些不常用的特性,比如在main函数之前和之后设置我们想要执行的函数,以及各种花式退......