最新python爬虫xpath教程_pycharm 对html代码使用xpath查询

最新推荐文章于 2024-05-13 23:48:00 发布

2401_84563605

最新推荐文章于 2024-05-13 23:48:00 发布

阅读量728

点赞数 13

分类专栏：程序员文章标签： python 爬虫 pycharm

版权声明：本文为博主原创文章，遵循 CC 4.0 BY-SA 版权协议，转载请附上原文出处链接和本声明。

本文链接：https://blog.csdn.net/2401_84563605/article/details/138415694

版权

导入文件：

好的，既然这样，说搞就搞，小白们，扑上来吧，要那种纯小白的，哈哈

在pycharm里边新建一个py文件

然后引入requests（请求库），以及lxml里边的etree，如下图

我们先打开豆瓣图书的一个网址，网址是“https://read.douban.com/kind/100”，如下图所示

定位爬取：

现在要做的就是去爬取“三体全集”，“评分”以及“小说简介”这三个内容，可是怎么爬呢，那就要用到了xpath这个定位利器，用过的人都说好，他好我也好！ //坏笑，坏笑

1.首先利用request进行get请求：

2.然后我们利用请求回来的r.con

最低0.47元/天解锁文章

关注

13
点赞
踩
10

收藏

觉得还不错? 一键收藏
0
评论
最新python爬虫xpath教程_pycharm 对html代码使用xpath查询

当我学到一定基础，有自己的理解能力的时候，会去阅读一些前辈整理的书籍或者手写的笔记资料，这些笔记详细记载了他们对一些技术点的理解，这些理解是比较独到，可以学到不一样的思路。Python所有方向的技术点做的整理，形成各个领域的知识点汇总，它的用处就在于，你可以按照下面的知识点去找对应的学习资源，保证自己学得较为全面。在豆瓣网阅读的网页，我们点击F12，然后点击控制台的箭头，点击一下页面上的三体全集，我们就可以找到该元素的位置了。好的，既然这样，说搞就搞，小白们，扑上来吧，要那种纯小白的，哈哈。
复制链接

扫一扫

专栏目录

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。