Pycharm中安装Scrapy框架并初始化项目

前言
Scrapy是一个开源的网络爬虫框架,Python编写的。最初设计用于网页抓取,也可以用来提取数据使用API或作为一个通用的网络爬虫。是数据采集不可必备的利器。

安装

pip install scrapy


如果使用上面的命令太慢。国内可以使用豆瓣源进行加速。

pip install -i  https://pypi.douban.com/simple scrapy 


注意要写错了,是 https://pypi.douban.com/simple 很多包都可以使用这个源进行加速,这也是pip的一个技巧,还可以使用阿里云进行加速。

安装完成之后在命令行输入

scrapy -v

如果出现了相应的版本号就说明安装成功。

创建项目
目前还没有IDE 能够创建scrapy的项目,我们必须手动初始化项目。 
1、找一个目录 
输入命令

scrapy startproject SpiderObject

命令行出现这样的结果说明创建成果

You can start your first spider with:
    cd SpiderObject
    scrapy genspider example example.com

去文件夹中看看 


初始化项目
使用pycharm打开该项目 

如果出现这个页面就说明对了。 

下面生成一个模板 
打开pycharm的terminal 


Terminal中 输入

scrapy genspider BiduSpider http://www.baidu.com

我们的spider 包下面会多一个文件 

这说明我们的spider创建成功。可以在pytharm中使用这个 强大的框架了。
 

转载于:https://my.oschina.net/u/193508/blog/3098961

  • 0
    点赞
  • 2
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值