利用python爬取古诗文网中各类古诗的方法

用途
可以拿去用于个人知识库、知识图谱的创建等其他学习用途。

使用
输入古诗文网的链接,即可爬取该页面所有诗歌的诗名,作者,朝代,内容,译文,注释,赏析,创作背景。

输出的json格式如下:

例如我要爬取唐诗三百首,先去古诗文网获得唐诗三百首的网址链接:

右侧的古诗三百,宋词三百,小学古诗等都可以爬取你只需要拿到链接就可以了。

运行python代码,结果如下:

代码结构
完整爬虫代码见仓库:GitHub - palp1tate/fetch-gushiwen: 获取古诗文网各类古诗

声明
本爬虫代码仅可用于个人学习用途,切勿用于任何商业用途!!!

以上就是利用python爬取古诗文网中各类古诗的方法的详细内容,更多关于python爬取古诗文的资料请关注vb.net教程C#教程python教程SQL教程access 2010教程xin3721自学网

  • 0
    点赞
  • 0
    收藏
    觉得还不错? 一键收藏
  • 0
    评论
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值