Python爬虫入门案例6：scrapy的基本语法+使用scrapy进行网站数据爬取

最新推荐文章于 2024-07-26 17:36:26 发布

咸蛋_dd

最新推荐文章于 2024-07-26 17:36:26 发布

阅读量1.1k

点赞数 1

分类专栏： Python爬虫文章标签： python 爬虫 scrapy

本文链接：https://blog.csdn.net/weixin_62848089/article/details/130848763

版权

Python爬虫专栏收录该内容

8 篇文章 1 订阅

订阅专栏

几天前在本地终端使用pip下载scrapy遇到了很多麻烦，总是报错，花了很长时间都没有解决，最后发现pycharm里面自带终端！（狂喜），于是直接在pycharm终端里面写scrapy了

这样的好处就是每次不用切换路径了，pycharm会直接把路径定位到项目包的路径下，非常方便。

而且下载scrapy可以直接在一个文件里面写import scrapy，然后install scrapy包就可以了，很快就下完了。

这时候我们就可以直接进行scrapy程序的创建了。

基本语法：

（1）创建scrapy爬虫项目

scrapy startproject 项目名

（2）创建爬虫文件

scrapy genspider 爬虫文件名爬取的网页

（3）运行爬虫代码

scrapy crawl 爬虫的名字

这里的爬虫主代码，需要在spiders文件中写

下面举个例子，使用scrapy来爬取汽车之家的汽车型号，与其对应的价格

import scrapy


class CarsSpider(scrapy.Spider):
    name = "cars"
    allowed_domains = ["https://car.autohome.com.cn/price/brand-15.html"]
    start_urls = ["https://car.autohome.com.cn/price/brand-15.html"]

    def parse(self, response):
        print("-------------")
        name_list=response.xpath("//div[@class='main-title']/a/text()")
        price_list=response.xpath("//div[@class='main-lever']//span/span/text()")
        for i in range(len(name_list)):
            name=name_list[i].extract()
            price=price_list[i].extract()
            print("-------------")
            print(name,price)

爬取结果：

咸蛋_dd

关注

1
点赞
踩
2

收藏

觉得还不错? 一键收藏
1
评论
Python爬虫入门案例6：scrapy的基本语法+使用scrapy进行网站数据爬取

而且下载scrapy可以直接在一个文件里面写import scrapy，然后install scrapy包就可以了，很快就下完了。几天前在本地终端使用pip下载scrapy遇到了很多麻烦，总是报错，花了很长时间都没有解决，最后发现pycharm里面自带终端！这样的好处就是每次不用切换路径了，pycharm会直接把路径定位到项目包的路径下，非常方便。下面举个例子，使用scrapy来爬取汽车之家的汽车型号，与其对应的价格。，于是直接在pycharm终端里面写scrapy了。（1）创建scrapy爬虫项目。
复制链接

扫一扫

专栏目录