温馨提示×

温馨提示×

您好，登录后才能下订单哦！

密码登录×

忘记密码？

登录注册×

获取短信验证码

其他方式登录

点击登录注册即表示同意《亿速云用户服务条款》

用户登录×

账户密码登录

请使用微信扫描上方二维码

使用帮助

请求超时！

请点击重新获取二维码

Node.js如何爬取豆瓣数据

发布时间：2021-06-08 10:58:29 阅读：95 作者：小新栏目：web开发

前端开发者测试专用服务器限时活动，0元免费领，库存有限，领完即止！点击查看>>

这篇文章给大家分享的是有关Node.js如何爬取豆瓣数据的内容。小编觉得挺实用的，因此分享给大家做个参考，一起跟随小编过来看看吧。

这次给大家带来Node.js爬取豆瓣数据实例，Node.js爬取豆瓣数据的注意事项有哪些，下面就是实战案例，一起来看一下。

一直自以为自己vue还可以，一直自以为webpack还可以，今天在慕课逛node的时候，才发现，自己还差的很远。众所周知，vue-cli基于webpack，而webpack基于node，对node不了解，谈什么了解webpack。所以就自己给自己出了一道题，爬取豆瓣数据，目前还处于初级阶段。今天就浅谈爬取到豆瓣的数据，再另一个页面用自己的方式展现，后续会跟进。

1、需要解决的问题

搭建服务
怎么处理爬到的数据
怎么自动打开默认浏览器

2、搭建服务

搭建服务有好几种方式，一开始我用的http，但是http有个弊端就是不能解析https协议的url，所以就用了express，解析https协议的网址我用了request包，豆瓣的网址是https的，

今天爬取的是https://movie.douban.com/chart这个网址；如下图，我要获取的有三个部分，图片、电影名字、电影链接.

Node.js如何爬取豆瓣数据

Node.js如何爬取豆瓣数据

3、怎么处理爬到的数据

我们用request爬到的数据，怎么处理呢？cheerio包可以让我们像Jq那样处理爬到的html数据。

①、首先解析数据，取到爬取网页的html数据；

Node.js如何爬取豆瓣数据

②、然后利用cheerio包操作爬到的数据，取到你想要的数据。

Node.js如何爬取豆瓣数据

③、取到数据，创建html，输出到页面。如下图，我用的字符串拼接，办法有点笨，还没有找到更好的办法。

Node.js如何爬取豆瓣数据

4、怎么自动打开默认浏览器

不知道你有没有看vue-cli中webpack的配置，自动打开浏览器，vue-cli用的opn包.

Node.js如何爬取豆瓣数据

这个包用起来很方便，引入包，直接调用opn（url）即可；

5、展示

Node.js如何爬取豆瓣数据

Node.js如何爬取豆瓣数据

感谢各位的阅读！关于“Node.js如何爬取豆瓣数据”这篇文章就分享到这里了，希望以上内容可以对大家有一定的帮助，让大家可以学到更多知识，如果觉得文章不错，可以把它分享出去让更多的人看到吧！

亿速云「云服务器」，即开即用、新一代英特尔至强铂金CPU、三副本存储NVMe SSD云盘，价格低至29元/月。点击查看>>

向AI问一下细节

推荐阅读：

免责声明：本站发布的内容（图片、视频和文字）以原创、转载和分享为主，文章观点不代表本网站立场，如果涉及侵权请联系站长邮箱：is@yisu.com进行举报，并提供相关证据，一经查实，将立刻删除涉嫌侵权内容。

上一篇新闻：
openDatabase数据库web前端缓存的示例分析
下一篇新闻：
$http与ajax的同步请求的示例分析

猜你喜欢

AI
助
手

产品服务

地区划分

专题活动

帮助支持

关于我们

售后咨询

7*24小时在线电话：400-100-2938

7*24小时在线 QQ：800811969

关注亿速云

亿速云公众号

手机网站二维码