emmm,感谢豆瓣提供的平台,爬也没那么多反爬虫机制。于是顺手爬了。。。
# coding:utf-8
# 采集豆瓣书信息和图片,写进数据库from urllib import parse
from urllib import request
from lxml import etree
import json, pymysql
import time
biaoqianmen=[ '外国文学', '文学' , '随笔' ,
'中国文学' , '经典' , '日本文学' , '散文' ,
'村上春树' , '诗歌' , '童话' , '儿童文学' ,
'古典文学' , '王小波' , '杂文' , '名著',
'余华' , '张爱玲' , '当代文学' , '钱钟书' ,
'外国名著' , '鲁迅' , '诗词' , '茨威格' ,
'米兰·昆德拉' , '杜拉斯' , '港台' ,
'漫画 , 推理' , '绘本' , '青春' ,
'东野圭吾' , '科幻' , '言情' , '悬疑' ,
'奇幻' , '武侠',