Node.js爬取豆瓣数据

时间 2019-12-11

原文原文链接

一直自觉得本身vue还能够，一直自觉得webpack还能够，今天在慕课逛node的时候，才发现，本身还差的很远。众所周知，vue-cli基于webpack，而webpack基于node，对node不了解，谈什么了解webpack。因此就本身给本身出了一道题，爬取豆瓣数据，目前还处于初级阶段。今天就浅谈爬取到豆瓣的数据，再另外一个页面用本身的方式展示，后续会跟进。html

一、须要解决的问题vue

①、搭建服务node

②、怎么处理爬到的数据webpack

③、怎么自动打开默认浏览器web

二、搭建服务vue-cli

搭建服务有好几种方式，一开始我用的http，可是http有个弊端就是不能解析https协议的url，因此就用了express，解析https协议的网址我用了request包，豆瓣的网址是https的，express

今天爬取的是https://movie.douban.com/chart这个网址；以下图，我要获取的有三个部分，图片、电影名字、电影连接.浏览器

三、怎么处理爬到的数据微信

咱们用request爬到的数据，怎么处理呢？cheerio包可让咱们像Jq那样处理爬到的html数据。url

①、首先解析数据，取到爬取网页的html数据；

②、而后利用cheerio包操做爬到的数据，取到你想要的数据。

③、取到数据，建立html，输出到页面。以下图，我用的字符串拼接，办法有点笨，尚未找到更好的办法。

四、怎么自动打开默认浏览器

不知道你有没有看vue-cli中webpack的配置，自动打开浏览器，vue-cli用的opn包.

这个包用起来很方便，引入包，直接调用opn（url）便可；

五、展现

关注微信公众号鸡汤小弟