为什么爬虫技术可以学,但不能乱用。?

爬虫合法不合法完全要看被爬取对象是不是认为你是合法的。技术当然本身没有违法,但是,也不像有几位答主说的爬虫本身就合法。下面来说一下原因:

爬虫获取的数据尤其是一些商业公司的网站,这些数据完全可以被认为是公司的财产,如果通过特殊手段获取的数据,也许会被公司认定为商业机密,同时,刑法中也有信息安全这类的法条。而且,一般来讲,除了学习其他场景下爬取数据肯定是为了牟利的。简单来说,你可以爬数据,但是,如果对方找你事儿,怎么都能告你,这至少是民事案件,如果涉及到信息安全,那就成了刑事案件。

当然,一般来讲,你不是天天怼着薅人家数据,也没人理你,毕竟,枪打出头鸟,你可以看看豆瓣这种网站,很多课程用其做范例,也没见他追究谁的责任,可你要真的爬了人家全站的东西,还去牟利,那就很危险了。

我也是python入门,从经济类专业转行的编程(说白了业务员转技术),现在写java和js,当初,在搞完python高级后,做了几个主流站的脚本做研究,例如:某博,某东,某宝。甚至是抢票脚本。但是,数据方面都是点到为止,只要证明脚本解决了问题就行。毕竟,只是用来学习。

另外,爬虫其实是一个上限极高的领域,很多课程用爬虫入门,是因为这很容易让学员建立起学习的信心,在HTML中拿数据的时候,也能更多的去练习语言基础,仅此而已。真要是商用,即便是网站这种,大多不是简单的技术就能搞定的。因为,作为一个刚入门的程序员,你不了解web应用是怎样的一个架构,也就没有太多的方法批量拿到网站的数据。甚至不知道前后端分离web应用,也就不知道后端接口这个概念,更不可能利用它。因此,初学者学习爬虫只是为了学习语言而已,这并不是你的饭碗,作为程序员你更不可能止步于此。继续研究学习下去吧。

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值