在Linux中curl是一个利用URL规则在命令行下工作的文件传输工具,可以说是一款很强大的http命令行工具。它支持文件的上传和下载,是综合传输工具,但按传统,习惯称url为下载工具。
语法
1 |
|
常见参数
1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 |
|
基本用法
1 |
|
执行后,www.form1.cn 的html就会显示在屏幕上了
这个方法也经常用于测试一台服务器是否可以到达一个网站
使用linux的重定向功能保存网页
1 |
|
使用curl的内置option:-o(小写)保存网页
1 |
|
执行完成后会显示如下界面,显示100%则表示保存成功
1 2 3 |
|
使用curl的内置option:-O(大写)保存网页中的文件
1 |
|
要注意这里后面的url要具体到某个文件,不然抓不下来
测试网页的返回值
1 |
|
在脚本中,这是很常见的测试网站是否正常的用法
指定proxy服务器以及其端口
很多时候上网需要用到代理服务器(比如是使用代理服务器上网或者因为使用curl别人网站而被别人屏蔽IP地址的时候),幸运的是curl通过使用内置option:-x来支持设置代理
1 |
|
有些网站是使用cookie来记录session信息。对于chrome这样的浏览器,可以轻易处理cookie信息,但在curl中只要增加相关参数也是可以很容易的处理cookie
保存http的response里面的cookie信息。内置option:-c(小写)
1 |
|
执行后cookie信息就被存到了cookiec.txt里面了
保存http的response里面的header信息。内置option: -D
1 |
|
执行后cookie信息就被存到了cookied.txt里面了
注意:-c(小写)产生的cookie和-D里面的cookie是不一样的。
使用cookie,很多网站都是通过监视你的cookie信息来判断你是否按规矩访问他们的网站的,因此我们需要使用保存的cookie信息。内置option: -b
1 |
|
模仿浏览器,有些网站需要使用特定的浏览器去访问他们,有些还需要使用某些特定的版本。curl内置option:-A可以让我们指定浏览器去访问网站
1 |
|
这样服务器端就会认为是使用IE8.0去访问的
伪造referer(盗链),很多服务器会检查http访问的referer从而来控制访问。比如:你是先访问首页,然后再访问首页中的邮箱页面,这里访问邮箱的referer地址就是访问首页成功后的页面地址,如果服务器发现对邮箱页面访问的referer地址不是首页的地址,就断定那是个盗连了
curl中内置option:-e可以让我们设定referer
1 |
|
这样就会让服务器其以为你是从www.form1.cn点击某个链接过来的
curl中get方式提交数据
1 |
|
curl中post方式提交数据
1 2 |
|
利用curl下载文件,使用内置option:-o(小写)
1 |
|
利用curl下载文件,使用内置option:-O(大写)
1 |
|
这样就会以服务器上的名称保存文件到本地
循环下载,有时候下载图片可以能是前面的部分名称是一样的,就最后的尾椎名不一样
1 |
|
这样就会把dodo1,dodo2,dodo3,dodo4,dodo5全部保存下来
下载重命名
1 |
|
由于下载的hello与bb中的文件名都是dodo1,dodo2,dodo3,dodo4,dodo5。因此第二次下载的会把第一次下载的覆盖,这样就需要对文件进行重命名。
1 |
|
这样在hello/dodo1.JPG的文件下载下来就会变成hello_dodo1.JPG,其他文件依此类推,从而有效的避免了文件被覆盖
分块下载,有时候下载的东西会比较大,这个时候我们可以分段下载。使用内置option:-r
1 2 3 4 |
|
这样就可以查看dodo1.JPG的内容了
通过ftp下载文件,curl可以通过ftp下载文件,curl提供两种从ftp中下载的语法
1 2 |
|
显示下载进度条
1 |
|
不会显示下载进度信息
1 |
|
curl可以通过内置option:-C同样可以达到断电续传的效果
如果在下载dodo1.JPG的过程中突然掉线了,可以使用以下的方式续传
1 |
|
上传文件,curl不仅仅可以下载文件,还可以上传文件。通过内置option:-T来实现
1 |
|
这样就向ftp服务器上传了文件dodo1.JPG
显示抓取错误
1 |
|
curl其他的可用参数如下
1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 20 21 22 23 24 25 26 27 28 29 30 31 32 33 34 35 36 37 38 39 40 41 42 43 44 45 46 47 48 49 50 51 52 53 54 55 56 57 58 59 60 61 62 63 64 65 66 67 68 69 70 71 72 73 74 75 76 77 78 79 80 81 82 83 84 85 86 87 88 89 90 91 92 |
|