Node.js爬取豆瓣数据

最新推荐文章于 2022-02-09 23:34:32 发布

weixin_34217773

最新推荐文章于 2022-02-09 23:34:32 发布

阅读量155

点赞数

文章标签： webpack javascript ViewUI

原文链接：https://juejin.im/post/5a9118176fb9a063577516a1

版权

一直自以为自己vue还可以，一直自以为webpack还可以，今天在慕课逛node的时候，才发现，自己还差的很远。众所周知，vue-cli基于webpack，而webpack基于node，对node不了解，谈什么了解webpack。所以就自己给自己出了一道题，爬取豆瓣数据，目前还处于初级阶段。今天就浅谈爬取到豆瓣的数据，再另一个页面用自己的方式展现，后续会跟进。

需要解决的问题

搭建服务
怎么处理爬到的数据
怎么自动打开默认浏览器

搭建服务

搭建服务有好几种方式，一开始我用的http，但是http有个弊端就是不能解析https协议的url，所以就用了express，解析https协议的网址我用了request包，豆瓣的网址是https的，

今天爬取的是https://movie.douban.com/chart这个网址；如下图，我要获取的有三个部分，图片、电影名字、电影链接。

怎么处理爬到的数据

我们用request爬到的数据，怎么处理呢？cheerio包可以让我们像Jq那样处理爬到的html数据。

①、首先解析数据，取到爬取网页的html数据；

②、然后利用cheerio包操作爬到的数据，取到你想要的数据。

③、取到数据，创建html，输出到页面。如下图，我用的字符串拼接，办法有点笨，还没有找到更好的办法。

怎么自动打开默认浏览器

不知道你有没有看vue-cli中webpack的配置，自动打开浏览器，vue-cli用的opn包。

这个包用起来很方便，引入包，直接调用opn（url）即可；

展示

关注微信公众号鸡汤小弟

转载于:https://juejin.im/post/5a9118176fb9a063577516a1

weixin_34217773

关注

0
点赞
踩
0

收藏

觉得还不错? 一键收藏
0
评论
Node.js爬取豆瓣数据

一直自以为自己vue还可以，一直自以为webpack还可以，今天在慕课逛node的时候，才发现，自己还差的很远。众所周知，vue-cli基于webpack，而webpack基于node，对node不了解，谈什么了解webpack。所以就自己给自己出了一道题，爬取豆瓣数据，目前还处于初级阶段。今天就浅谈爬取到豆瓣的数据，再另一个页面用自己的方式展现，后续会跟进。需要解决的问题搭建服务怎么处理...
复制链接

扫一扫

评论

被折叠的条评论为什么被折叠?

到【灌水乐园】发言

查看更多评论

添加红包

成就一亿技术人!

hope_wisdom

发出的红包

实付元

使用余额支付

点击重新获取

扫码支付

钱包余额 0

抵扣说明：

1.余额是钱包充值的虚拟货币，按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载，可以购买VIP、付费专栏及课程。