爬取豆瓣的图书信息

最新推荐文章于 2024-07-21 22:25:59 发布

飞花念惜

最新推荐文章于 2024-07-21 22:25:59 发布

阅读量1.6k

点赞数 1

分类专栏： python， python，爬虫文章标签： python 爬虫豆瓣

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/qq_35396598/article/details/79672261

版权

本文介绍如何利用Python进行网络爬虫，详细解析爬取豆瓣图书信息的过程，内容涵盖编码设置、请求发送及数据解析等步骤。

摘要由CSDN通过智能技术生成

emmm，感谢豆瓣提供的平台，爬也没那么多反爬虫机制。于是顺手爬了。。。

# coding:utf-8

# 采集豆瓣书信息和图片，写进数据库
from urllib import parse
from urllib import request
from lxml import etree
import json, pymysql
import time
biaoqianmen=[ '外国文学', '文学' , '随笔' ,
'中国文学' , '经典' , '日本文学' , '散文' ,
'村上春树' , '诗歌' , '童话' , '儿童文学' ,
'古典文学' , '王小波' , '杂文' , '名著',
'余华' , '张爱玲' , '当代文学' , '钱钟书' ,
'外国名著' , '鲁迅' , '诗词' , '茨威格' ,
'米兰·昆德拉' , '杜拉斯' , '港台' ,
'漫画 , 推理' , '绘本' , '青春' ,
'东野圭吾' , '科幻' , '言情' , '悬疑' ,
'奇幻' , '武侠',

最低0.47元/天解锁文章

关注

1
点赞
踩
3

收藏

觉得还不错? 一键收藏
0
评论
复制链接

分享到 QQ

分享到新浪微博

扫一扫

专栏目录

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。