Express 系列:结合实例讲解开发一个Node命令行工具
ztj100 2025-03-24 01:40 14 浏览 0 评论
导言:是不是对键盘上下指如飞,屏幕上除了黑黑的控制台什么都看不到的Geek羡慕的不要不要的,觉得前端是写的很爽,一行代码下去就是另一个世界,可是内心深处总还是觉得逼格不知不觉就降了下了?不用担心,让舒爽和逼格齐飞的好事Nodejs带给你,本章就带你一步步开发一个属于自己的命令行工具。
Now You See Me: 小伙伴们有什么不明白的地方或者觉得讲的不清楚的地方,敬请留言,区区在下也是开始研究没有多久,共同进步。。当然如果有想要知道的内容相关的小知识点,比如cheerio包balabala之类的,也可以留言告知,都会排进发布内容的日程表中。嘿嘿
1.要开发一个这样的工具干什么用呢?
笔者经常看一些网络小说,所以我们要来开发一个抓取笔者经常看的小说网站的某篇小说的最新更新的章节内容。先放一下程序运行的结果:
哒哒哒,是不是美美哒
以下是这个项目的地址,还只是个demo,后期还会增加各种功能和前段工程化的实践。
https://github.com/Alfred-Lau/n-novel#readme
2.如何搞?
分以下几个部分来讲解这个内容:
- 项目结构
- 项目细节
项目结构:
以下针对上述目录做点介绍:
目录:
bin :命令行脚本文件入口,也就是package.json中bin属性对应的值得目录
node_modules:你懂得,npm的依赖项聚集地
文件:
.npmignore:就像.gitignore文件一样,只不会被npm纳入发布目录的文件
index.js:主程序文件
package.json:npm init 生成。具体描述项目的情况
项目细节:
首先介绍一下大概设计:
很简单,就是首先根据提供的小说网站链接抓取到具体某本小说的目录导航,利用相关的npm包分析出最后一个项目的链接,也就是最新的更新链接,之后拼接链接。再次向目标网站请求数据。分析取回来的内容,整理格式,修饰输出,即得最终结果。
看一下我们的源代码:
index.js
//用来进行发送请求,久经考验的好基友
var request = require('request');
//Node爬虫界的大拿,分析网页代码很有一套
var cio = require('cheerio’);
//装饰命令行上面的输出,添加色彩等
var colors = require('colors');
var url = require('url');
//网站网址
var webSiteUrlPrefix = 'http://www.biquge.tw';
//小说链接
var webSiteUrl = 'http://www.biquge.tw/0_680/';
//开始请求数据
request(webSiteUrl, function(err, res, body) {
//做异常处理检查
if (!err && res.statusCode == 200) {
//cheerio进行数据处理的第一步,穿个马甲
var $ = cio.load(body);
//缓存最后一项的节点
var target = $('div#list dd:last-of-type');
//通过CSS selector来筛选数据
//这里表示
var src = target.children('a').attr('href');
//get文章标题
var pageTitle = target.text();
//得到文章实际地址
var contentsUrl = webSiteUrlPrefix + src;
//再次请求,这次得到文章的实际内容
request(contentsUrl, function(err, res, body) {
if (err) {
return;
} else {
if (res.statusCode == 200) {
var $ = cio.load(body);
//调整格式,去掉多余空格
var pageContents = $('div#content').text().replace(/\s+/g, '\n ');
//加点颜色看看
console.log(pageTitle.green + '\n\n' + pageContents.yellow);
} else {
return;
}
}
})
} else {
console.log('bad request');
}
});
接下来是bin/index.js的讲解:
和上面的文件基本完全一样,唯一不同的是:
#! /usr/bin/env node
表示启用Node来运行脚本,这也是生成命令行工具的精髓
最后是package.json文件介绍:
和之前的 Express 系列:结合实例讲解如何开发一个自己的npm包 类似,唯一不同的是:
"bin": {
"n-novel": "bin/index.js"
}
这里提示各位,一定要将包含“#! /usr/bin/env node”的index.js文件路径写入这里,因为这里面的文件最终会被软连接到/usr/local/bin/里面去,而那里的程序运行方式都是脚本,位置失误的话,程序运行会出错哦。
3.发布流程
首先编辑自己的.npmignore文件
其次确认自己已注册npm账号,可以通过如下命令来检查
$ npm whoami
发布(打不打tag都可以)
$ npm publish
哒哒哒,发布成功!
4.起来嗨
发布之后我们要检查自己的战斗成果,通过
Npm install -g n-novel
安装到全局,运行结果如下:
然后运行n-novel,稍待片刻,新鲜出炉的小说最新章节就放到了你的命令行上面。
下节介绍
Intro
经过以上两节的学习,我们既能开发属于自己的包,又能写得了命令行工具,是不是觉得自己已然飞起?下节我们将要介绍怎样通过持续结成和构建保证自己的项目代码都是久经测试的,杠杠的靠得住,也就是持续集成:travis,测试覆盖:coveralls,查看模块依赖:david-dm等等。
相关推荐
- 30天学会Python编程:16. Python常用标准库使用教程
-
16.1collections模块16.1.1高级数据结构16.1.2示例...
- 强烈推荐!Python 这个宝藏库 re 正则匹配
-
Python的re模块(RegularExpression正则表达式)提供各种正则表达式的匹配操作。...
- Python爬虫中正则表达式的用法,只讲如何应用,不讲原理
-
Python爬虫:正则的用法(非原理)。大家好,这节课给大家讲正则的实际用法,不讲原理,通俗易懂的讲如何用正则抓取内容。·导入re库,这里是需要从html这段字符串中提取出中间的那几个文字。实例一个对...
- Python数据分析实战-正则提取文本的URL网址和邮箱(源码和效果)
-
实现功能:Python数据分析实战-利用正则表达式提取文本中的URL网址和邮箱...
- python爬虫教程之爬取当当网 Top 500 本五星好评书籍
-
我们使用requests和re来写一个爬虫作为一个爱看书的你(说的跟真的似的)怎么能发现好书呢?所以我们爬取当当网的前500本好五星评书籍怎么样?ok接下来就是学习python的正确姿...
- 深入理解re模块:Python中的正则表达式神器解析
-
在Python中,"re"是一个强大的模块,用于处理正则表达式(regularexpressions)。正则表达式是一种强大的文本模式匹配工具,用于在字符串中查找、替换或提取特定模式...
- 如何使用正则表达式和 Python 匹配不以模式开头的字符串
-
需要在Python中使用正则表达式来匹配不以给定模式开头的字符串吗?如果是这样,你可以使用下面的语法来查找所有的字符串,除了那些不以https开始的字符串。r"^(?!https).*&...
- 先Mark后用!8分钟读懂 Python 性能优化
-
从本文总结了Python开发时,遇到的性能优化问题的定位和解决。概述:性能优化的原则——优化需要优化的部分。性能优化的一般步骤:首先,让你的程序跑起来结果一切正常。然后,运行这个结果正常的代码,看看它...
- Python“三步”即可爬取,毋庸置疑
-
声明:本实例仅供学习,切忌遵守robots协议,请不要使用多线程等方式频繁访问网站。#第一步导入模块importreimportrequests#第二步获取你想爬取的网页地址,发送请求,获取网页内...
- 简单学Python——re库(正则表达式)2(split、findall、和sub)
-
1、split():分割字符串,返回列表语法:re.split('分隔符','目标字符串')例如:importrere.split(',','...
- Lavazza拉瓦萨再度牵手上海大师赛
-
阅读此文前,麻烦您点击一下“关注”,方便您进行讨论和分享。Lavazza拉瓦萨再度牵手上海大师赛标题:2024上海大师赛:网球与咖啡的浪漫邂逅在2024年的上海劳力士大师赛上,拉瓦萨咖啡再次成为官...
- ArkUI-X构建Android平台AAR及使用
-
本教程主要讲述如何利用ArkUI-XSDK完成AndroidAAR开发,实现基于ArkTS的声明式开发范式在android平台显示。包括:1.跨平台Library工程开发介绍...
- Deepseek写歌详细教程(怎样用deepseek写歌功能)
-
以下为结合DeepSeek及相关工具实现AI写歌的详细教程,涵盖作词、作曲、演唱全流程:一、核心流程三步法1.AI生成歌词-打开DeepSeek(网页/APP/API),使用结构化提示词生成歌词:...
- “AI说唱解说影视”走红,“零基础入行”靠谱吗?本报记者实测
-
“手里翻找冻鱼,精心的布局;老漠却不言语,脸上带笑意……”《狂飙》剧情被写成歌词,再配上“科目三”背景音乐的演唱,这段1分钟30秒的视频受到了无数网友的点赞。最近一段时间随着AI技术的发展,说唱解说影...
- AI音乐制作神器揭秘!3款工具让你秒变高手
-
在音乐创作的领域里,每个人都有一颗想要成为大师的心。但是面对复杂的乐理知识和繁复的制作过程,许多人的热情被一点点消磨。...
你 发表评论:
欢迎- 一周热门
- 最近发表
-
- 30天学会Python编程:16. Python常用标准库使用教程
- 强烈推荐!Python 这个宝藏库 re 正则匹配
- Python爬虫中正则表达式的用法,只讲如何应用,不讲原理
- Python数据分析实战-正则提取文本的URL网址和邮箱(源码和效果)
- python爬虫教程之爬取当当网 Top 500 本五星好评书籍
- 深入理解re模块:Python中的正则表达式神器解析
- 如何使用正则表达式和 Python 匹配不以模式开头的字符串
- 先Mark后用!8分钟读懂 Python 性能优化
- Python“三步”即可爬取,毋庸置疑
- 简单学Python——re库(正则表达式)2(split、findall、和sub)
- 标签列表
-
- idea eval reset (50)
- vue dispatch (70)
- update canceled (42)
- order by asc (53)
- spring gateway (67)
- 简单代码编程 贪吃蛇 (40)
- transforms.resize (33)
- redisson trylock (35)
- 卸载node (35)
- np.reshape (33)
- torch.arange (34)
- npm 源 (35)
- vue3 deep (35)
- win10 ssh (35)
- vue foreach (34)
- idea设置编码为utf8 (35)
- vue 数组添加元素 (34)
- std find (34)
- tablefield注解用途 (35)
- python str转json (34)
- java websocket客户端 (34)
- tensor.view (34)
- java jackson (34)
- vmware17pro最新密钥 (34)
- mysql单表最大数据量 (35)