【下载文档: Python下载网络小说实例代码.txt 】
(友情提示:右键点上行txt文档名->目标另存为)
Python下载网络小说实例代码 看网络小说一般会攒上一波,然后导入Kindle里面去看,但是攒的多了,机械的Ctrl+C和Ctrl+V实在是OUT,所以就出现了此文。
其实Python我也是小白,用它的目的主要是它强大文本处理能力和网络支持,以及许多好用的库,不需要自己造轮子。而且真心比C方便啊(真是用了才知道)
分析要获取的网页我要获取的主要是3个东西: 文章的标题。
正文 第一章 北灵院
文章正文内容。
下一章的URL。下一页
还有就是注意网页的编码,这个网页的编码是GBK,但在实际运行过程中,我用GBK会出现网页解码错误:UnicodeDecodeError: ‘gbk' codec can't decode bytes in position 2-3: illegal multibyte sequence所以换用了gb18030,问题就解决了,因为一般修仙网络小说中,会出现各种王霸之气的文字,你们懂得,所以需要更加牛逼文字库,你们感受一下博大精深的字符编码。源代码
我就知道,大家要这个,哈哈哈。
主函数
#主函数
if __name__ == '__main__':
global numChapter
global NOVERL NOVERL = '大主宰.txt'
#NOVERL = '择天记.txt'
NOVER