python拷贝漫画下载爬虫(附代码github链接)

宵忍

已于 2023-10-15 15:37:21 修改

阅读量4.2k

点赞数 3

文章标签：爬虫 github

于 2023-10-15 15:28:02 首次发布

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/ldl345/article/details/133843139

版权

先附上github链接：GitHub - muzi-xiaoren/kaobei_Crawler: 拷贝漫画爬虫

主要使用selenium库模拟浏览器来获取kaobei动态加载的html页面。

用BeautifulSoup进行解析。然后传入函数先获取url。

将url传入get.py中使用多线程编程加快下载速率

下面是具体函数及使用方法。

download.py 和 get.py 是方法函数，不需要修改。pic是md图片存放处。

kaobei_spider_1.py

使用临时账号和密码登陆，需要登陆的原因是有一些漫画不登陆不可见 (在50和51行处,可以不用修改也可以修改成你的账号和密码)

56行处修改漫画页面的url，修改成页面显示如下图时的url。从浏览器复制就行。

下载的图片新存放于本文件夹中的一个kaobei_images中。

kaobei_spider_2.py

使用的是本机浏览器，例如代码中的Chrome浏览器如果你的浏览器中已经登陆了拷贝网站，那么就可以省去登陆的步骤。

但是配置起来比较麻烦，教程见教程 Chrome浏览器的复用_--remote-debugging-port=9222_Mengmeng.Nie的博客-CSDN博客

建议直接使用kaobei_spider_1的账号密码登陆

最后是一些注意事项

由于使用多线程下载，对每张图片使用一个新的线程进行下载。所以可能会比较吃网速，导致一些报错。如果出现这种情况，可以如下解决。
1. 一次运行完后，再次运行py程序，因为图片会先检测是否存在，不会重复下载。基本多运行几次就可以完全下载。
2. 取消get.py第20行的注释，让所有下载图像的线程创建完成后停一秒后再返回，时间也可以多加一些。
程序运行时请让浏览器的页面保持在屏幕中，不要最小化到任务栏中，不然页面不会进行更新。
kaobei_spider_2.py目前运行完成后不能自动关闭，需要手动结束一下进程。当然最好等一会，因为打印出最后下载章数的时候，可能还有一些下载图片的进程在运行。
下载的漫画全部存放于一个文件夹中，文件名格式由章节数_图片顺序_url中部分字符串构成。如下所示。

博客等级

码龄4年

17
原创

54
点赞

79
收藏

24
粉丝

关注

私信

热门文章

最新评论

7-42 实验7_7_连续子序列 (100 分)
zhangyuhan9034: if(de==0) break; 为什么要有这句呢
汉兜 Handle 运行github项目后，打开链接白屏
宵忍: 可以使用nonebot配置到qq里面，但是需要专门的服务器来搭建，除非你有一台闲置的电脑可以24h不关机。
pip3 install docker-compose报错 Getting requirements to build wheel ... error
宵忍: kali还是推荐使用apt-get 安装docker
Git CVE-2024-32002漏洞利用
CSDN-Ada助手: 恭喜您发布了第15篇博客“Git CVE-2024-32002漏洞利用”，内容深度且实用，展现了您对技术领域的深刻理解。希望您能继续保持创作的热情和坚持，不断分享优质的内容给大家。或许下一步可以考虑深入探讨漏洞修复方法或者安全加固措施，为读者提供更全面的技术指导。期待您更加精彩的创作！
pip3 install docker-compose报错 Getting requirements to build wheel ... error
CSDN-Ada助手: 恭喜您发布了第13篇博客！对于pip3 install docker-compose报错的问题，您已经做出了很好的总结和解决方法。接下来，我建议您可以尝试分享更多关于Docker和相关技术的实践经验，或者深入探讨一些技术细节，让读者能够更好地理解和应用。期待您的下一篇作品！祝您创作顺利！

最新文章

目录

评论 1

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。