学习Node.js:raw-body模块源码解析
raw-body是什么
raw-body
的主要功能是处理HTTP请求体的原始数据。它提供了以下核心功能:
- 解析请求体:可以从HTTP请求中提取原始数据,包括文本和二进制数据。
- 配置选项:通过配置项,可以设置请求体的大小限制、编码方式等参数。
- 异常处理:模块能够处理异常情况,如请求体超出限制。
- 编码转换:支持将原始数据解码为指定编码的字符串,或者返回
Buffer
实例。
express
中的body-parser
中间件就使用了raw-body
来处理请求
raw-body基础用法
安装:
npm install raw-body
引入:
var getRawBody = require('raw-body')
****
getRawBody函数签名如下:
getRawBody(stream, [options], [callback])
stream是需要解析的流。
options是一些配置项。
length
- 流的长度。limit
- 请求体的大小限制。比如1000
、'500kb'
或'3mb'
。encoding
- 用于将请求体解码为字符串的编码。默认情况下,如果未指定编码,将返回Buffer
实例。最有可能的是,您需要utf-8
,因此将encoding
设置为true
将解码为utf-8
callback
是解析完成之后的回调函数。
结合express
一起使用的例子如下:
也可以使用promise
风格调用getRawBody
:
raw-body v0.0.3源码阅读
我们选择的版本是v0.0.3,选择这个版本的原因非常简单:代码量非常少,只有70行
- 主要作用是处理一些异常,当请求体内容超过限制时会调用
stream.resume
这个方法销毁这个stream
,防止请求数据被缓冲。 - 监听
stream
的一些事件,然后使用回调进行处理,stream
之所以能调用on
、once
、removeListener
等方法,是因为stream
继承了Nodejs中的EventEmitter
模块。- data事件:每当可读流接收到新的数据块时,就会触发
data
事件。一般用于逐块处理请求体数据。 - end事件:
end
事件在可读流读取完数据后触发,表示数据流结束。 - error事件:当可读流发生错误时触发
error
事件。 - close事件:
close
事件在可读流关闭时触发,表示流已经被关闭,用于在流关闭时进行一些资源清理或收尾工作
- data事件:每当可读流接收到新的数据块时,就会触发
onData
onData
的核心代码只有这两行:
吧收到的chunk
放到buffers
数组里面,chunk
的数据类型默认是Buffer
类型
然后使用 chunk.length
返回当前chunk
的字节数,并累加起来
onEnd
onEnd
的核心是57行:调用传入的回调函数,并吧Buffer.concat
的结果传入
Buffer.concat
方法会吧 buffers
中的所有 Buffer
实例连接在一起,返回一个新的 Buffer
cleanup
cleanup
中的主要逻辑就是调用removeListener
对请求数据流的事件监听器进行清理,可以防止内存泄漏以及不必要的资源占用。
v0.0.3版本的代码看完之后我们再看看看v2.5.2的
raw-body v2.5.2源码阅读
2.5.2版本的代码有300多行,是0.0.3版本的四倍,不过核心功能是差不多的,差异点如下:
options
配置项新增了encoding
参数:用于吧body解码成指定编码的字符串,默认情况下,如果没有指定编码,将返回一个Buffer
实例,stream
增加了aborted
事件的处理:stream.on('aborted', onAborted)
raw-body依赖的模块
2.5.2版本依赖了5个npm模块
先看一下这些模块的功能:
bytes
是一个用于在不同单位之间进行字节转换的Nodejs模块。常用方法如下:
http-errors
用于创建HTTP错误对象。它简化了处理HTTP请求时生成错误响应的过程。也可以和Express
,Koa
,Connect
一起使用。用法如下:
iconv-lite
用于处理字符编码的转换。可以在不同的字符编码之间进行转换。
unpipe
用于取消可读流(Readable Stream)和可写流(Writable Stream)之间的数据传输。例如从文件读取流到HTTP响应流。unpipe
库允许你取消这种数据传输。
getRawBody
是入口函数,我们一起看一下:
- 针对参数做一些验证以及错误处理
- 调用
bytes
模块的parse
方法解析传入的limit
参数 - 调用
readStream
函数处理stream
,这里做了判断,如果传入了回调函数,则使用回调的方式传递解析之后stream
,否则使用promise
风格来处理
readStream
函数和v0.0.3版本的代码变化不太大:
- 调用
getDecoder
函数,用于获取指定编码的解码器。而getDecoder
函数里面又调用了iconv
模块的getDecoder
方法 - 监听
stream
的aborted
事件**,**当客户端中止 HTTP 请求时,可读流会触发aborted
事件。比如在请求尚未完成时客户端提前关闭了连接。onAborted
函数如下:
核心逻辑就是调用createError
创建一个错误信息,然后调用done
函数。
done
函数是readStream
里面需要重点关注的函数,代码如下:
1,将complete
标记为true
,表示这个流已经处理完了。
2,判断done
函数的调用环境,如果是在同步代码块,则使用process.nextTick
延迟invokeCallback
函数的调用。
done
函数同步调用是在这几个地方:
异步调用则是在stream.on
事件的几个回调函数中,并在212行标记为异步:
3,根据done
函数第一个参数判断是否有错误,如果有错误则调用halt
方法处理stream
,halt
方法会提前结束stream
的读取操作。
halt
函数内容如下:
unpipe(stream)
会断开与这个流相关的其他管道,如果有其他流正在处理 stream
输出的数据,这些流不会收到来自 stream
的数据。
pause
方法是 Nodejs
可读流的一个方法,用于将流暂停,停止触发 data
事件,不再传递数据。
总结
本文我们了解了raw-body
的简单使用,raw-body
模块也是Nodejs
生态中使用的很频繁的一个模块,通过对v0.0.3和v2.5.2版本源码的解析,也了解了内部实现。
参考资料
https://github.com/stream-utils/raw-body