豆瓣读书top250数据爬取与可视化

最新推荐文章于 2024-05-17 20:08:24 发布

置顶

魏谦

最新推荐文章于 2024-05-17 20:08:24 发布

阅读量3.4k

点赞数 1

分类专栏：爬虫文章标签：大数据 python

本文链接：https://blog.csdn.net/qq_45767564/article/details/111352554

版权

爬虫–scrapy

题目：根据豆瓣读书top250,根据出版社对书籍数量分类，绘制饼图

搭建环境

import scrapy
import numpy as np
import pandas as pd
import matplotlib.pyplot as plt

加载scrapy框架


#terminal 终端实现
cd .. # 跳转到上一层目录
scrapy startproject booktop # 和项目同名的scrapy框架项目

setting配置

ROBOTSTXT_OBEY = False # 君子协议 false 不遵守
USER_AGENT = 'Mozilla/5.0 (Windows NT 6.1; Win64; x64) AppleWebKit/537.36
(KHTML, like Gecko) Chrome/85.0.4183.121 Safari/537.36'
DOWNLOAD_DELAY = 0.5 # 下载延迟## 如何改变文本的样式

spider编写


#spiders文件夹下创建python文件 bookspider.py
import scrapy
from booktop.items import BookItem
class BookSpider(scrapy.Spider):
		name="bookspider"
		al

最低0.47元/天解锁文章

确定要放弃本次机会？

福利倒计时

: :

立减 ¥

普通VIP年卡可用

立即使用

魏谦

关注关注

1
点赞
踩
19

收藏

觉得还不错? 一键收藏
0
评论
豆瓣读书top250数据爬取与可视化

爬虫–scrapy题目：根据豆瓣读书top250,根据出版社对书籍数量分类，绘制饼图搭建环境import scrapyimport numpy as npimport pandas as pdimport matplotlib.pyplot as plt加载scrapy框架#terminal 终端实现cd .. # 跳转到上一层目录scrapy startproject booktop # 和项目同名的scrapy框架项目setting配置ROBOTSTXT_OBEY = F
复制链接

扫一扫