nodejs简单抓包工具使用详解

Sela ·

更新时间:2024-11-15

· 525 次阅读

前言

就是简简单单写程序的我为什么需要抓包？

其实在平时写demo的时候需要用到一些图片和文本的资源的，但是需求量比较大，这个时候就想去网站上面直接复制啊，然后图片另存为啊，什么的一系列繁琐的操作。

但是现在不需要了，你只要看到这篇文章，你就很轻松了。本项目Github地址：

https://github.com/xiaoqiuxiong/reptileDemo

1.在你的电脑桌面新建一个reptileDemo文件夹。

然后进入文件夹，然后在改文件夹目录下打开cmd。输入下图所示回车，连续按回车即可。

初始化完之后，你会在文件夹里面看下package.json文件，里面就是一些基本的包管理基本配置。

2.cmd输入下图所示，然后回车

这步是安装cheerio模块，主要是用来解释html和使用jqueryAPI来操作请求返回的html。

3.cmd输入下图所示，然后回车

这步是安装request模块，主要是用来发请求处理的。

4.文件夹内添加一个data文件夹，用来存放抓包的数据。

5.文件夹内新建app.js文件。添加内容如下:


let fs = require('fs');
let cheerio = require('cheerio');
let request = require('request');
let path = require('path');
let i = 0;
let j = 0;
//初始需要抓取的页面url 
let url = "http://www.silver.org.cn/cjyw/list_p_1.html";
let http = url.includes('https') ? require('https') : require('http');
function startRequest(x) {
  // 采用http模块向服务器发起一次get请求   
  http.get(x, function(res) {
    // 用来存储请求网页的整个html内容
    var html = '';
    var titles = [];
    // 防止中文乱码
    res.setEncoding('utf-8'); 
    // 监听data事件，每次取一块数据
    res.on('data', function(chunk) {
      html += chunk;
    });
    // 监听end事件，如果整个网页内容的html都获取完毕，就执行回调函数
    res.on('end', function() {
      // 采用cheerio模块解析html
      var $ = cheerio.load(html); 
      j = 0;
      savedContent($);
      i++;
      console.log('抓包页码：' + i);
      // 限制请求页数
      if (i <= 10) {
        fetchPage(`http://www.silver.org.cn/cjyw/list_p_${i}.html`);
      } else {
        console.log('抓包完成');
      };
    });
  }).on('error', function(err) {
    console.log(err);
  });
}
//保存内容
function savedContent($) {
  var item = $('.lt_col li')[j]
  // 标题
  var x = $(item).find('h2').text().trim();
  // 内容
  var y = $(item).find('p').text().trim();
  // 图片地址
  var z = $(item).find('img').attr('src');
  // 图片文件名
  var o = path.basename(z);
  // 创建文件夹
  fs.mkdir(`./data/${x}`, err => {
    if (!err) {
      // 保存文本
      fs.appendFile(`./data/${x}/index.txt`, `标题：${x}\n内容：${y}`, 'utf-8', err => {
        if (err) {
          console.log(`****创建txt失败****： ${x}`);
        }
      });
      // 保存图片
      request.head(z, (err, res, body) => {
        if (err) {
          console.log(`****请求图片失败****： ${x}`);
        }
      });
      // 写图片到本地
      request(z).pipe(fs.createWriteStream(`./data/${x}/${o}`));
      j++;
      if (j <= $('.lt_col li').length - 1) {
        savedContent($)
      }
    }
  })
}
startRequest(url); //主程序开始运行

本项目主要是抓取一个新闻网站的新闻列表数据，有标题，内容和图片。

6.package.json修改如下：


"scripts": {
  "test": "echo \"Error: no test specified\" && exit 1",
  "dev": "node app.js"
 },

完结。

做完上面操作之后你就可以使用cmd，然后输入

预览

这样就搞定了，是不是很爽啊。

疯狂的程序员决不是靠狂妄和拼命的程序员，而是能够脚踏实地，持续努力的程序员，一个程序员真正做到这两点，技术上去后，唯一能限制他的只有想象力，到那个时候才算“疯狂的程序员”，这种程序员，才能令对手无比恐惧。

抓包工具工具抓包

1024 个赞

需要登录后方可回复, 如果你还没有账号请注册新账号

PostgreSQL LOCK（锁）

Carol 2020-03-12

725

CentOS上运行ZKEACMS的详细过程

Obelia 2020-05-21

791

进一步深入Ruby中的类与对象概念

Freda 2020-05-22

873

Golang环境搭建及打包和工具链详解

Karli 2023-04-16

1840

postgresql数据库导出和导入及常用的数据库管理工具

Cybill 2023-04-20

673

一文教会你配置使用Navicat或PLSQL可视化工具远程连接Oracle

Cybill 2023-04-24

Java并发包工具类CountDownLatch的应用详解

Malinda 2023-04-28

1758

Java多线程同步工具类CyclicBarrier的使用

Tricia 2023-04-28

1145

RedisDesktopManager(Redis可视化工具)安装及使用图文教程

Jacinthe 2023-04-28

476

Linxu下性能指标采集工具之nmon工具的使用

Lala 2023-04-28

1117

python轻量级性能工具-Locust详解

Dulcea 2023-05-04

1671

Go mod包管理工具详解

Fern 2023-05-12

1333

C#实现文件筛选读取并翻译的自动化工具

Jennifer 2023-05-12

431

Avalonia封装实现指定组件允许拖动的工具类

Talia 2023-05-12

553

强烈推荐一个基于.NetFramework开发的Windows右键菜单管理工具

Malinda 2023-05-13

1819

基于Python制作一个简单的文章搜索工具

Frieda 2023-05-13

796

基于Python自制一个文件解压缩小工具

Diane 2023-06-06

Go生成base64图片验证码实例(超详细工具类)

Fawn 2023-07-17

1506

关于如何使用Flutter开发执行操作系统shell命令的工具详解

Lala 2023-07-21

1559

Android App 如何防止抓包方法及分析

Ophelia 2023-07-21

1665

我要提问

致谢

帮助他人，成就自己。

人生最大成功就是伸出热情而温暖的双手，尽自己所能去帮助身边的每一个人，只要无私的奉献，就会收获到美好的生活。

1024问感谢每一位朋友的帮助和支持。

软件开发网提供编程的基础软件技术培训教程,软件开发编程实例讲解Go,Node,HTML,CSS,Javascript,Python,Java,Ruby,C,PHP,MySQL等软件开发编程语言以及数据开发的基础知识，也提供大量的软件开发在线实例、从入门到精通就在1024问。

育儿网微养生全球行美食街育儿菜谱大全海南旅游女性养狗百科星座