为什么 TCP 协议有粘包问题

时间：2020-10-21 10:03:48 来源：作者：

链接：https://draveness.me/whys-the-design-tcp-message-frame/

为什么这么设计（Why’s THE Design）是一系列关于计算机领域中程序设计决策的文章，我们在这个系列的每一篇文章中都会提出一个具体的问题并从不同的角度讨论这种设计的优缺点、对具体实现造成的影响。如果你有想要了解的问题，可以在文章下面留言。

TCP/IP 协议簇建立了互联网中通信协议的概念模型，该协议簇中的两个主要协议就是 TCP 和 IP 协议。TCP/ IP 协议簇中的 TCP 协议能够保证数据段（Segment）的可靠性和顺序，有了可靠的传输层协议之后，应用层协议就可以直接使用 TCP 协议传输数据，不在需要关心数据段的丢失和重复问题[^1]。

tcp-and-Application-protocols

图 1 - TCP 协议与应用层协议

IP 协议解决了数据包（Packet）的路由和传输，上层的 TCP 协议不再关注路由和寻址[^2]，那么 TCP 协议解决的是传输的可靠性和顺序问题，上层不需要关心数据能否传输到目标进程，只要写入 TCP 协议的缓冲区的数据，协议栈几乎都能保证数据的送达。

当应用层协议使用 TCP 协议传输数据时，TCP 协议可能会将应用层发送的数据分成多个包依次发送，而数据的接收方收到的数据段可能有多个『应用层数据包』组成，所以当应用层从 TCP 缓冲区中读取数据时发现粘连的数据包时，需要对收到的数据进行拆分。

粘包并不是 TCP 协议造成的，它的出现是因为应用层协议设计者对 TCP 协议的错误理解，忽略了 TCP 协议的定义并且缺乏设计应用层协议的经验。本文将从 TCP 协议以及应用层协议出发，分析我们经常提到的 TCP 协议中的粘包是如何发生的：

TCP 协议是面向字节流的协议，它可能会组合或者拆分应用层协议的数据；
应用层协议的没有定义消息的边界导致数据的接收方无法拼接数据；

很多人可能会认为粘包是一个比较低级的甚至不值得讨论的问题，但是在作者看来这个问题还是很有趣的，不是所有人都系统性地学过基于 TCP 的应用层协议设计，也不是所有人对 TCP 协议也没有那么深入的理解，相信很多人学习编程的过程都是自底向上的，所以作者认为这是一个值得回答的问题，我们应该传递正确的知识，而不是负面的和居高临下的情绪。

面向字节流

TCP 协议是面向连接的、可靠的、基于字节流的传输层通信协议[^3]，应用层交给 TCP 协议的数据并不会以消息为单位向目的主机传输，这些数据在某些情况下会被组合成一个数据段发送给目标的主机。

Nagle 算法是一种通过减少数据包的方式提高 TCP 传输性能的算法[^4]。因为网络带宽有限，它不会将小的数据块直接发送到目的主机，而是会在本地缓冲区中等待更多待发送的数据，这种批量发送数据的策略虽然会影响实时性和网络延迟，但是能够降低网络拥堵的可能性并减少额外开销。

在早期的互联网中，Telnet 是被广泛使用的应用程序，然而使用 Telnet 会产生大量只有 1 字节负载的有效数据，每个数据包都会有 40 字节的额外开销，带宽的利用率只有 ~2.44%，Nagle 算法就是在当时的这种场景下设计的。

当应用层协议通过 TCP 协议传输数据时，实际上待发送的数据先被写入了 TCP 协议的缓冲区，如果用户开启了 Nagle 算法，那么 TCP 协议可能不会立刻发送写入的数据，它会等待缓冲区中数据超过最大数据段（MSS）或者上一个数据段被 ACK 时才会发送缓冲区中的数据。

nagle-algorithm

图 2 - Nagle 算法

几十年前还会发生网络拥塞的问题，但是今天的网络带宽资源不再像过去那么紧张，在默认情况下，linux 内核都会使用如下的方式默认关闭 Nagle 算法：

TCP_NODELAY = 1

Linux 内核中使用如下所示的 tcp_nagle_test 函数测试我们是否应该发送当前的 TCP 数据段，感兴趣的读者可以以这段代码为入口详细了解 Nagle 算法在今天的实现：

static inline bool tcp_nagle_test(const struct tcp_sock *tp, const struct sk_buff *skb,

unsigned int cur_mss, int nonagle)

{

if (nonagle & TCP_NAGLE_PUSH)

return true;

if (tcp_urg_mode(tp) || (TCP_SKB_CB(skb)->tcp_flags & TCPHDR_FIN))

return true;

if (!tcp_nagle_check(skb->len < cur_mss, tp, nonagle))

return true;

return false;

}

Nagle 算法确实能够在数据包较小时提高网络带宽的利用率并减少 TCP 和 IP 协议头带来的额外开销，但是使用该算法也可能会导致应用层协议多次写入的数据被合并或者拆分发送，当接收方从 TCP 协议栈中读取数据时会发现不相关的数据出现在了同一个数据段中，应用层协议可能没有办法对它们进行拆分和重组。

除了 Nagle 算法之外，TCP 协议栈中还有另一个用于延迟发送数据的选项 TCP_CORK，如果我们开启该选项，那么当发送的数据小于 MSS 时，TCP 协议就会延迟 200ms 发送该数据或者等待缓冲区中的数据超过 MSS[^5]。

无论是 TCP_NODELAY 还是 TCP_CORK，它们都会通过延迟发送数据来提高带宽的利用率，它们会对应用层协议写入的数据进行拆分和重组，而这些机制和配置能够出现的最重要原因是 — TCP 协议是基于字节流的协议，其本身没有数据包的概念，不会按照数据包发送数据。

消息边界

如果我们系统性地学习过 TCP 协议以及基于 TCP 的应用层协议设计，那么设计一个能够被 TCP 协议栈任意拆分和组装数据包的应用层协议就不会有什么问题。既然 TCP 协议是基于字节流的，这其实就意味着应用层协议要自己划分消息的边界。

如果我们能在应用层协议中定义消息的边界，那么无论 TCP 协议如何对应用层协议的数据包进程拆分和重组，接收方都能根据协议的规则恢复对应的消息。在应用层协议中，最常见的两种解决方案就是基于长度或者基于终结符（Delimiter）。

message-framing

图 3 - 实现消息边界的方法

基于长度的实现有两种方式，一种是使用固定长度，所有的应用层消息都使用统一的大小，另一种方式是使用不固定长度，但是需要在应用层协议的协议头中增加表示负载长度的字段，这样接收方才可以从字节流中分离出不同的消息，HTTP 协议的消息边界就是基于长度实现的：

HTTP/1.1 200 OK

Content-Type: text/html; charset=UTF-8

Content-Length: 138

Connection: close

<html>

<head>

<title>An Example Page</title>

</head>

<body>

<p>Hello World, this is a very simple HTML document.</p>

</body>

</html>

在上述 HTTP 消息中，我们使用 Content-Length 头表示 HTTP 消息的负载大小，当应用层协议解析到足够的字节数后，就能从中分离出完整的 HTTP 消息，无论发送方如何处理对应的数据包，我们都可以遵循这一规则完成 HTTP 消息的重组[^6]。

不过 HTTP 协议除了使用基于长度的方式实现边界，也会使用基于终结符的策略，当 HTTP 使用块传输（Chunked Transfer）机制时，HTTPz 头中就不再包含 Content-Length 了，它会使用负载大小为 0 的 HTTP 消息作为终结符表示消息的边界。

当然除了这两种方式之外，我们可以基于特定的规则实现消息的边界，例如：使用 TCP 协议发送 JSON 数据，接收方可以根据接收到的数据是否能够被解析成合法的 JSON 判断消息是否终结。

总结

TCP 协议粘包问题是因为应用层协议开发者的错误设计导致的，他们忽略了 TCP 协议数据传输的核心机制 — 基于字节流，其本身不包含消息、数据包等概念，所有数据的传输都是流式的，需要应用层协议自己设计消息的边界，即消息帧（Message Framing），我们重新回顾一下粘包问题出现的核心原因：

TCP 协议是基于字节流的传输层协议，其中不存在消息和数据包的概念；
应用层协议没有使用基于长度或者基于终结符的消息边界，导致多个消息的粘连；

网络协议的学习过程非常有趣，不断思考背后的问题能够让我们对定义有更深的认识。到最后，我们还是来看一些比较开放的相关问题，有兴趣的读者可以仔细思考一下下面的问题：

基于 UDP 协议的应用层协议应该如何设计？会出现粘包的问题么？
有哪些应用层协议使用基于长度的分帧？又有哪些使用基于终结符的分帧？

Tags：TCP 协议点击:() 评论:()

声明：本站部分内容及图片来自互联网,转载是出于传递更多信息之目的,内容观点仅代表作者本人,如有任何标注错误或版权侵犯请与我们联系(Email:2595517585@qq.com)，我们将及时更正、删除，谢谢。

▌相关推荐

为什么 TCP 协议有粘包问题

TCP/IP 协议簇建立了互联网中通信协议的概念模型，该协议簇中的两个主要协议就是 TCP 和 IP 协议。TCP/ IP 协议簇中的 TCP 协议能够保证数据段（Segment）的可靠性和顺序，有了可靠的传输层协议之后，应用层协议就可以直接使用...【详细内容】

2020-10-21　　Tags: TCP 协议点击:(71)　　评论:(0)　　加入收藏

▌简易百科推荐

HTTP 报文详解

HTTP 报文是在应用程序之间发送的数据块,这些数据块将通过以文本形式的元信息开头，用于 HTTP 协议交互。请求端(客户端)的 HTTP 报文叫做请求报文，响应端(服务器端)的叫做响应...【详细内容】

2021-12-27　　程序员蛋蛋　　　　Tags:HTTP 报文　点击:(0)　　评论:(0)　　加入收藏

网络基本概念和测试

一网络概念：1.带宽：标识网卡的最大传输速率，单位为 b/s,比如 1Gbps，10Gbps，相当于马路多宽2.吞吐量：单位时间内传输数据量大小单位为 b/s 或 B/s ,吞吐量/带宽，就是网络的使用率...【详细内容】

2021-12-27　　码农世界　　　　Tags:网络　点击:(2)　　评论:(0)　　加入收藏

TCP/IP 网络模型有几层？分别有什么用？

1.TCP/IP 网络模型有几层？分别有什么用？ TCP/IP网络模型总共有五层 1.应用层:我们能接触到的就是应用层了，手机，电脑这些这些设备都属于应用层。 2.传输层:就是为应用层提供网络...【详细内容】

2021-12-22　　憨猪哥08　　　　Tags:TCP/IP 　点击:(29)　　评论:(0)　　加入收藏

一文带你搞定TCP连接队列

TCP握手的时候维护的队列半连接队列（SYN队列）全连接队列（accepted队列）半连接队列是什么？服务器收到客户端SYN数据包后，Linux内核会把该连接存储到半连接队列中，并响应SYN+ACK报...【详细内容】

2021-12-21　　DifferentJava　　　　Tags:TCP 　点击:(9)　　评论:(0)　　加入收藏

下一代互联网快要来了？分清楚Web3和Web3.0再说！

你好，这里是科技前哨。随着“元宇宙”概念的爆火，下一代互联网即将到来，也成了互联网前沿热议的话题，12月9日美国众议院的听证会上，共和党议员Patrick McHenry甚至宣称，要调整现...【详细内容】

2021-12-17　　王煜全　　　　Tags:Web3 　点击:(14)　　评论:(0)　　加入收藏

Curator客户端子节点监听机制源码分析

一、demopublic static void main(String[] args) throws Exception { RetryPolicy retryPolicy = new ExponentialBackoffRetry( 1000, 3);...【详细内容】

2021-12-15　　程序员阿龙　　　　Tags:Curator 　点击:(20)　　评论:(0)　　加入收藏

计算机网络知识点全面总结（这也太全了吧！）

一、计算机网络概述 1.1 计算机网络的分类按照网络的作用范围：广域网（WAN）、城域网（MAN）、局域网（LAN）；按照网络使用者：公用网络、专用网络。1.2 计算机网络的层次结构 TCP/IP四层模...【详细内容】

2021-12-14　　一口Linux　　　　Tags:网络知识　点击:(30)　　评论:(0)　　加入收藏

为什么手机成功连接WiFi却没办法上网？路由器：这锅我可不背

无论是在外面还是在家里，许多人都习惯了用手机连接 WiFi 进行上网。不知道大家有没有遇到过这样一种情况，明明已经显示成功连接 WiFi，却仍然提示“网络不可用”或“不可上网”...【详细内容】

2021-12-14　　UGREEN绿联　　　　Tags:WiFi 　点击:(25)　　评论:(0)　　加入收藏

WiFi 跑不满千兆的原因，今天终于搞懂了

拉了千兆宽带，买了标称 1300Mbps 的无线路由器，为什么 WiFi 还是跑不满千兆？要回答这个问题，我们先得知道这个 1300Mbps 是怎么来的。开始回答之前先说明一下，这期只讲 802.11ac，...【详细内容】

2021-12-14　　Ubiquiti优倍快　　　　Tags:WiFi 　点击:(83)　　评论:(0)　　加入收藏

网络问题排查-IPv6环境下VIP地址不通

问题背景IPv6环境下，在浏览器中通过http://[vip:port]访问web业务，提示无法访问此网站，[vip]的响应时间过长。分析过程之前碰到过多次在PC浏览器上无法访问vip的情况，排查方法也...【详细内容】

2021-12-13　　云原生知识星球　　　　Tags:网络问题　点击:(27)　　评论:(0)　　加入收藏

推荐资讯

远程软件发展迅猛，ToDe	倒计时！企业QQ即将下架
极简Windows11与iPhon	iPhone信号问题，花10元
惊人数据：App Store中4	个人所得税递延纳税报
非常实用的 Python 库	等离子电视技术先进，为