scrapy笔记

1.scrapy是一个基于异步 + 多线程的方式运行爬虫的框架,内部的函数都是通过回调的方式执行的,不能手动调用.

2.创建srapy项目

3.scrapy项目构成

4.把数据写入json文件中命令

scrapy crawl baidu -o baidu.json -s FEED_EXPORT_ENCIDING = utf-8

5.把数据写入csv中命令

scrapy crawl baidu -o baidu.csv -s FEED_EXPORT_ENCIDING = utf-8

6.在cmd中爬虫项目进行调试

scrapy shell + start_url

7.python json.dumps与json.dump的区别

json.dumps(): 将dict转化为str

json.loads(): 将str转化为dict

json.dump(): 将dict转化为str后,存入文件中,与文件操作结合起来了


评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值