问一个简单的问题:你有没有遇到过这种情况,明明宽带带宽拉满,下载文件却像挤牙膏一样,速度忽快忽慢,有时候甚至稳定在极低的速率一动不动?或者视频会议开到一半画面开始卡成马赛克,但测速软件却显示网络一切正常。
这类问题的根源,往往不在你的网卡,也不在运营商,而是TCP协议里那两套被无数人挂在嘴边、却很少有人真正讲透的机制——流量控制和拥塞控制。说它们决定了整个互联网的生死一点都不夸张,没有这两套机制,网络早就被数据包冲垮了。
这篇文章就是把TCP/IP协议族里这两个重量级概念掰开揉碎。我会用实际的窗口变化过程、具体的协商参数、以及我在定位真实网络问题时踩过的坑,把滑动窗口、慢启动、拥塞避免、快重传、快恢复这些名词背后的原理和关联讲清楚。不管你是刚入门的学生,还是已经写了好几年网络程序的工程师,这篇文章都值得你花十五分钟读完。
1. 流量控制:接收端才是真正的“限速器”
很多人第一次接触TCP,都会被“可靠传输”“三次握手”这些概念吸引,却忽略了TCP还有一个非常朴素的职责:不能让发送端把接收端撑爆。
1.1 停等协议的效率瓶颈
要理解流量控制,先回到一个最原始的模型。假设发送端每次只发一个数据包,然后停下来等接收端确认,收到ACK后再发下一个。这个模型叫停等协议。它够简单,也够可靠,但效率低得让人发指。
我们来算笔账。假设网络中发送端到接收端的往返时间(RTT)是100毫秒,也就是0.1秒,每个报文段大小是1KB,那么即使带宽再大,这条链路的吞吐上限就是:
code复制1KB / 0.1s = 10KB/s
这个速率放到今天,连看一张高清图都费劲。问题出在哪?链路的大部分时间都在空等,数据在飞行途中的那些时间完全被浪费了。你辛辛苦苦拉了一条千兆光纤,结果TCP一次只允许一个报文段在线路上跑,这跟用卡车运货却每次只装一个包裹有什么区别?
所以,TCP需要让多个报文段同时“在飞”,也就是在未收到确认之前,允许连续发送多个数据包。但这就带来一个问题:如果发送端一口气把所有数据全丢到网络上,接收端的缓冲区很可能会被瞬间填满,新到的数据没地方放,只能丢弃,丢弃了又得重传,反而更慢。
1.2 滑动窗口的工作逻辑
流量控制的解决方案,就是引入滑动窗口。接收端会在TCP报文段头部的窗口字段中,告诉发送端自己还有多少可用的接收缓冲区空间,这个值叫接收窗口(rwnd,receiver window)。
发送端维护一个发送窗口,它的边界由已经发送但未确认的数据和接收端通告的rwnd共同决定。只要发送窗口还没耗尽,发送端就可以继续发新数据;一旦窗口用完,就必须停下来等待ACK把窗口往前滑动。
这里有个关键细节:窗口是动态变化的。接收端每确认一批数据,缓冲区就释放一批空间,rwnd就会变大,发送端就能发更多数据。反过来,如果接收端应用程序处理数据的速度赶不上到达速度,rwnd就会缩小,发送端就不得不放慢节奏。
举个实际的例子。假设接收端通告rwnd为4000字节,发送端已经发送了0到3999字节,窗口就是0到4000这个范围。如果收到确认0-999字节的ACK,并且接收端此时又有2000字节的新缓冲区空闲,那rwnd可能变成5000字节,发送窗口就会向前滑动到下一个位置,同时允许发送的数据范围就变成了1000到5999字节。
我用一个表格来展示这个过程,这样更直观:
| 事件 | 已确认字节 | 接收端空闲缓冲区 | 新rwnd | 发送窗口可用范围 |
|---|---|---|---|---|
| 初始 | 0 | 4000 | 4000 | 0~3999 |
| 收到ACK 0-999 | 1000 | 3000 | 3000 | 1000~3999 |
| 应用程序读取2000字节 | 1000 | 5000 | 5000 | 1000~5999 |
| 收到ACK 1000-1999 | 2000 | 4000 | 4000 | 2000~5999 |
看到没有,接收窗口像一扇可以伸缩的闸门,闸门开多大,发送端就能涌多少数据。这个机制彻底解决了“发送端把接收端缓冲区塞爆”的问题,因为发送端永远只能发送接收端确认过得去的数据量。
1.3 零窗口与窗口探测
当接收端的缓冲区彻底满了,也就是应用程序长时间没有读取数据,TCP会通告一个零窗口(rwnd=0)。零窗口下发送端必须立即停止发送数据,否则就是在往一个已经满溢的桶里倒水。
但这里有个陷阱:如果发送端一直傻等,接收端什么时候能腾出空间?等接收端的应用程序读取了数据,如何通知发送端?
TCP的解决办法是:发送端启动一个持续计时器(persist timer),周期性向接收端发送一个特殊的窗口探测报文,这个报文通常只有1字节数据。接收端收到探测报文后,即使缓冲区仍然满,也会回复一个包含最新rwnd的ACK。一旦rwnd大于零,发送端就可以恢复发送。
我在调试一个嵌入式网络设备时遇到过这个问题。设备端的TCP接收缓冲区只有8KB,但业务逻辑处理很慢,几乎每秒才读取一次数据。主机发送速率稍微一快,设备就疯狂回零窗口。抓包用Wireshark看,能看到大量的ZeroWindow和ZeroWindowProbe标记,传输吞吐被直接打到了几乎为零。后来把设备端的接收缓冲调大,同时优化了上层读取逻辑,这个问题才彻底消失。
这里要特别提醒:不要把流量控制和拥塞控制混为一谈。流量控制管的是“接收方能不能处理过来”,它衡量的是端到端两端的接收能力差异;拥塞控制管的是“中间网络能不能扛得住”。一个是点对点的刹车,一个是全局路况的限流,两码事。
需要模型API调用? 免费领10W Token,多模型网关一键接入 Claude、DeepSeek 等主流模型。
2. 拥塞控制:网络路径上的“隐形瓶颈”
如果说流量控制解决的是“接收端缓冲区会不会爆”,那拥塞控制解决的就是另一个问题:如果路由器中间某个节点的缓存被填满,整个网络会发生什么?
2.1 慢启动:从1个报文段开始试探
先抛一个反直觉的事实:TCP在连接刚建立时,并不会一上来就满速发送。恰恰相反,它只发送一个报文段,然后等ACK。这就是慢启动。
为什么要这么谨慎?因为发送端不知道这条网络路径的容量有多大。局域网里当然可以肆无忌惮,但如果是跨洋链路,中间的瓶颈路由器可能在非常低的速率下就会丢包。如果一上来就猛灌数据,等于主动把自己卷入拥塞崩溃。
慢启动的规则是这样的:初始时拥塞窗口(cwnd,congestion window)设置为1个MSS(最大报文段长度,通常是1460字节)。每收到一个ACK,cwnd增加1个MSS。这个增长看起来是线性的,但因为ACK是随着数据到达而不断返回的,实际效果是每个RTT内cwnd翻倍。
我们来列一个窗口增长表:
| RTT序号 | 第1个RTT发送 | 收到ACK数 | cwnd(MSS数) |
|---|---|---|---|
| 1 | 1 | 1 | 2 |
| 2 | 2 | 2 | 4 |
| 3 | 4 | 4 | 8 |
| 4 | 8 | 8 | 16 |
这个翻倍过程会一直持续,直到达到慢启动阈值(ssthresh,slow start threshold)。换句话说,慢启动阶段窗口是指数增长,增长速度极快。从1个报文段到1024个报文段,只需要10个RTT。如果你的RTT只有20毫秒,那么200毫秒之后窗口就涨到了1024个MSS,大约是1.5MB。
看到这里你可能就会明白,慢启动这个名字其实有点误导。它并不慢,它只是“慢的起点”,从1个报文段开始,但增长速度快到惊人。
2.2 拥塞避免:进入线性增长
当cwnd超过ssthresh后,TCP进入拥塞避免阶段。这个阶段的规则是:每个RTT内,cwnd只增加1个MSS。如果说慢启动是踩油门,那拥塞避免就是保持匀速巡航,窗口从指数增长切换成线性增长。
为什么要切换?因为在接近网络实际容量的区域,加倍扩张窗口的风险太高了。假设带宽延迟积(BDP)是100个MSS,你从50个MSS直接翻倍到100个,这还没问题;但如果从100个翻倍到200个,就必然造成瞬时过载和大量丢包。所以TCP选择在这个阶段更加谨慎,用线性增长一点点探路上限。
一个常见的困惑是“ssthresh初始值到底是什么”。早期的TCP实现倾向于把它设得很大,比如64KB或更大。现代Linux等操作系统会根据路由的往返时间等参数做动态调整,但一般情况下,初始ssthresh可以看作是系统预设的“未知网络容量上限的猜测值”。需要注意,ssthresh不是一成不变的,拥塞发生后会被动态改变。
2.3 拥塞发生时的反应:窗口回退
光会增长、不会收缩的拥塞控制就是耍流氓。TCP检测拥塞的依据是丢包。而丢包的两种主要表现是:超时重传和收到重复ACK。对应不同的表现,窗口回退的策略也有区别。
先看最严重的情况:超时重传。发送方发出了一个报文段,但在RTO(重传超时时间)内没有收到对应ACK,这通常意味着网络丢包严重,甚至路径可能已经中断。这种情况下,TCP会将ssthresh设置为当前cwnd的一半,然后把cwnd降为1个MSS,重新开始慢启动。
这背后的逻辑是:超时已经说明网络连一个RTT周期都无法完成正常的数据确认了,必须用最保守的方式重新试探路径容量。
再看较轻微的拥塞情况:收到重复ACK。TCP没有为乱序数据连续发送多个ACK(通常3个重复ACK),说明网络中有一个报文段丢了,但后续数据还在正常到达。这种情况下不需要把cwnd打回1,只需要执行后面要讲的快重传和快恢复机制。
这里我先给出一个拥塞控制状态变迁的整体对照表:
| 事件 | cwnd变化 | ssthresh变化 | 进入的机制 |
|---|---|---|---|
| 连续收到ACK(慢启动) | cwnd += 1 MSS | 不变 | 慢启动 |
| 连续收到ACK(拥塞避免) | cwnd += MSS/cwnd | 不变 | 拥塞避免 |
| 超时重传 | cwnd = 1 MSS | cwnd/2 | 慢启动 |
| 收到3个重复ACK | cwnd = ssthresh + 3 MSS | cwnd/2 | 快恢复 |
表格越到后面越接近本文的核心重点,先记住这个框架,后面的内容会一一展开。
3. 快重传与快恢复:不用等超时的补救机制
在纯超时重传时代,TCP有一个让人抓狂的问题:丢包后等待时间太长了。RTO是基于实时测量的RTT估算出来的,通常比RTT大不少,在RTT较大的链路上甚至可能达到几百毫秒到一秒以上。如果一个报文段丢了,发送端要等RTO到期才重传,这期间宝贵的传输资源完全被浪费。
有没有办法让发送端更快地意识到丢包?有,靠重复ACK。
3.1 三个重复ACK的含义
假设发送端连续发送了1到5号报文段。其中2号报文段在网络中丢失了,3、4、5号报文段正常到达接收端。TCP是累积确认机制,接收端收到3号报文段后,虽然数据不连续,但它不能确认3号,只能再次确认“我期望的是2号”,于是回复ACK 2。收到4号也回复ACK 2,收到5号同样回复ACK 2。
发送端收到连续3个“ACK 2”,也就是3个重复ACK后,基本可以断定2号报文段丢了。这时,不需要等RTO超时,立即重传2号报文段,这就是快重传。
但这里有一个细节需要注意:接收到重复ACK并不能100%确定丢包,也有可能是IP层乱序到达。如果实际只是乱序,3号只是个较早到达的报文段,而此时1号、2号也许正在路上。所以TCP才会设置“3个重复ACK”这个触发阈值——不是收到一个重复ACK就重传,而是连续3个,这已经能大概率排除乱序的可能。
快重传的核心价值就是把等价于“丢包信号”的时间从RTO缩短到大致一个RTT。对于高RTT链路,这个优化量非常可观。
3.2 快恢复的窗口计算
光重传还不够,窗口如何进行收缩才合理?如果一丢包就回到慢启动的cwnd=1,那也是矫枉过正了,因为既然接收端还能持续返回ACK,说明链路并没有完全堵死,网络还是有相当的传输能力的。
所以TCP引入了快恢复机制,规则是这样的:
- 收到3个重复ACK时,把ssthresh设置为当前cwnd的一半。
- cwnd先设置为ssthresh加上3个MSS(也就是因为收到3个重复ACK,数据包已经离开了网络),
- 之后每收到一个重复ACK,cwnd临时增加1个MSS,允许发送一个新的报文段。
- 当收到新的ACK(确认了新数据)时,cwnd回落到ssthresh值,正式进入拥塞避免阶段。
用数字举个例。假设当前cwnd=200个MSS,ssthresh初始较大。收到3个重复ACK后:
code复制ssthresh = 200 / 2 = 100个MSS
cwnd = 100 + 3 = 103个MSS
后面每收到一个重复ACK,cwnd加1,最多可以再发送几个新报文段。等到收到新ACK时,cwnd回到100。这个过程实际上让TCP在拥塞发生后既不放弃治疗,也不盲目硬冲。
写到这里,我想起有一次在排查跨地域数据同步任务慢的问题时,抓包看到大量重复ACK和快速重传频繁出现。链路质量差,丢包率在1%左右。由于快恢复机制的存在,虽然拥塞但吞吐没有掉到零,而是持续在一个较低水平波动。后来通过把传输改为多个并行TCP连接来分摊风险,整体同步效率才提上来。
快重传和快恢复是从TCP Tahoe到TCP Reno演进的核心分水岭。Tahoe里丢包后一律cwnd=1重来,而Reno引入了“用重复ACK触发重传+窗口折半恢复”的机制。今天绝大多数TCP实现都基于Reno及其后继者(比如NewReno、CUBIC等),理解了Reno就等于理解了整个拥塞控制的地基。
4. 两个窗口如何共同决定发送速率
现在流量控制和拥塞控制各自的关键机制都讲完了,但在真实TCP实现里,发送端实际能发出的数据量,同时受这两个窗口的交集约束。
4.1 实际发送窗口的公式
发送端的有效发送窗口计算公式是:
code复制有效发送窗口 = min(rwnd, cwnd)
也就是说,接收端允许发多少(rwnd),网络允许发多少(cwnd),取两者较小值。一个很通俗的类比是:rwnd是餐厅的座位数,cwnd是通往餐厅的道路能容纳的车流量,实际能同时就餐的人数取决于座位数和道路通行能力中的较小值。
这个公式揭示了一条非常关键的原则:流量控制和拥塞控制是互相独立、但又共同作用的限制维度。无论哪一方成为瓶颈,都会直接影响发送速率。
举个例子。假设接收端缓冲区巨大,通告rwnd为1MB,但拥塞窗口只有64KB,那么实际发送窗口就是64KB,瓶颈在网络,而不是接收端。反过来,如果网络非常好,cwnd增长到了1MB,但接收端通告rwnd只有256KB,那实际发送窗口就是256KB,瓶颈在接收端的处理能力。
这个公式也解释了为什么有些技术人员在调优时只关注接收缓冲区大小是片面的。我在实际工作中经常看到有人为了提升吞吐,把socket接收缓冲区调得巨大,但网络上仍然上不去。这时候去看ss输出,如果cwnd一直小于rwnd,说明瓶颈在拥塞控制侧,需要重新审视链路的丢包率、RTT,以及拥塞控制算法的选择。
4.2 常见误解澄清
关于这两个窗口,我见过太多误区,挑几个典型的说说。
第一个误区:“流量控制就是滑动窗口,拥塞控制就是慢启动”。这句话只对了一半。滑动窗口是实现流量控制的载体,但流量控制的核心是rwnd限制;慢启动只是拥塞控制的一个阶段,拥塞控制还包括拥塞避免、快重传、快恢复。两者不能画等号。
第二个误区:“接收窗口越大越好”。在一定范围内确实如此,但窗口大到超过BDP后,继续增长只会白白浪费内存。因为发送窗口再大,也受限于链路能够容纳的在飞数据量。BDP的计算公式是带宽 × RTT,比如100Mbps带宽、20ms RTT的链路,BDP大约为:
code复制100 * 10^6 bit/s * 0.02 s = 2 * 10^6 bit ≈ 250KB
这时候你设置1MB的接收缓冲区,效果和250KB几乎相同,纯属浪费。
第三个误区:“丢包就一定触发发送端降低速率”。实际上,如果是轻微的乱序导致重复ACK,快重传会触发但没有跌回慢启动;如果链路中有主动队列管理(AQM)机制(比如CoDel),它可能会在缓冲区满之前就主动丢弃包,让TCP提前感知拥塞,而不是等缓冲区全满才丢包。这属于现代拥塞控制的一个扩展点,但核心逻辑依然是丢包反馈。
关于窗口字段还有一个常见的补充点:TCP头部里那个16位的窗口字段最大只能表示65535字节,但如今带宽动辄Gbps级,这个上限远远不够。所以就有了窗口缩放(Window Scale)选项。在三次握手阶段,双方通过TCP选项协商一个缩放因子,使得实际窗口可以达到65535 * 2^scale字节。比如scale为7,最大窗口能到约8MB。如果你抓包时发现Window Size数值后面跟了一个[scale factor]标记,就能理解它的作用了。
5. 实测与调优:亲眼看到拥塞窗口的变化
理论讲得再多,不如亲眼看一次窗口变化来得深刻。我在调优TCP传输性能时,最常用的工具是ss、Wireshark和tcpdump。下面把这些实测方法和几个关键经验分享出来。
5.1 用ss命令查看实时窗口状态
在Linux服务器上,一条命令就能看到连接的双端窗口状态:
bash复制ss -ti
输出中会有cwnd、ssthresh、rwnd等字段,以及当前的拥塞控制算法名称。我举个例子:
code复制State Recv-Q Send-Q Local Address:Port Peer Address:Port Process
ESTAB 0 0 10.0.0.1:5000 10.0.0.2:4000
cubic cwnd:64 ssthresh:32 rwnd:64240
这里的cwnd:64表示当前拥塞窗口为64个MSS,ssthresh:32表示下次拥塞发生时会收缩到32,rwnd:64240是接收端通告的窗口大小。如果cwnd持续小于rwnd,且网络没有明显丢包,说明拥塞控制算法把速率限制住了;如果rwnd远小于cwnd,则说明接收端处理速度是瓶颈。
用ss -ti观察文件传输过程中的窗口变化,你可以非常直观地想明白一个道理:TCP不是一个“恒定速率”的协议,它的速率是以窗口为核心的动态波动过程。
5.2 Wireshark中的关键视图
Wireshark是另一个绝佳工具。抓包后,通过Statistics -> TCP Stream Graph -> Time-Sequence Graph (Stevens)可以看发送序列号随时间的变化。图形的曲线斜率代表发送速率,平台期代表窗口耗尽的等待,折线台阶则代表慢启动和拥塞避免的窗口变化。
看这个图的时候,有几个特征非常醒目:
- 慢启动阶段曲线陡峭向上,斜率不断翻倍;拥塞避免阶段曲线变得平缓,斜率放缓。
- 如果出现重复ACK和快速重传,在时间序列图上能看到一个明显的“回弹”又继续前进的台阶。
- 如果出现超时重传,则会出现一段长时间的停顿,然后曲线从很低的起点重新开始。
对于Windows或者macOS上用Wireshark看Window字段,要注意TCP Window Scale选项的存在。很多时候你看到的Window值是65535,但实际窗口可能是它的数倍,要乘以缩放因子。如果不注意这个,容易误判接收端窗口太小。
5.3 内核参数调优的取舍
Linux系统下有几个和拥塞控制密切相关的内核参数,经常被我用来做网络性能调优。
首先是拥塞控制算法的选择:
bash复制# 查看当前支持的拥塞控制算法
sysctl net.ipv4.tcp_available_congestion_control
# 设置拥塞控制算法为cubic(或bbr)
sysctl -w net.ipv4.tcp_congestion_control=cubic
在没有特殊环境的情况下,我个人建议默认维持操作系统的默认算法即可。如果链路是高带宽高延迟(例如跨洋专线),可以试试BBR。BBR不再以丢包作为拥塞信号,而是通过估算瓶颈带宽和最小RTT来主动调整发送速率,在丢包率较高的链路上比CUBIC提升非常显著。
其次是慢启动相关的参数:
bash复制# 查看空闲连接是否重置cwnd(默认是1,即重置)
sysctl net.ipv4.tcp_slow_start_after_idle
# 置为0,可以让空闲连接保留已有cwnd,避免重新慢启动
sysctl -w net.ipv4.tcp_slow_start_after_idle=0
这个参数影响很大。TCP连接空闲一段时间后,如果tcp_slow_start_after_idle=1,拥塞窗口会被重置为初始值,下次传输又要从头慢启动。对于长连接、间歇性传输的场景(比如数据库连接池、消息队列),这会造成不小的性能损耗。把该参数置0后,空闲连接能保留之前的cwnd,传小消息时速度明显更快。
还有一个和rwnd相关的参数:
bash复制# 查看TCP接收缓冲区自动调优范围
sysctl net.ipv4.tcp_rmem
默认值一般是4096 131072 6291456,三个值分别代表最小值、默认值、最大值。对于需要高吞吐的应用,可以把默认值调大,或者在应用层用setsockopt的SO_RCVBUF显式设置来避开自动调优的限制。
不过在这里我想提醒一句:调参之前先明确瓶颈在哪。如果网络本身丢包率高,调再大的缓冲区也没用;如果连接数极少,增大缓冲区确实有收益。调优一定是按需进行、测试验证的,不要照搬网上那些“万能配置”。没有真正理解问题就套参数,结果很容易适得其反。
6. 排错经验:从现象到根因
最后这部分,我结合自己的排障经历,把流量控制和拥塞控制相关的问题从现象到根因捋一遍。这类问题在工程中太常见了,而且现象表现往往相似,误判率很高。
6.1 常见现象与瓶颈判断
先看一张快速定位表,把常见现象和可能的根因对应起来:
| 现象 | 最大可能原因 | 怎么确认 |
|---|---|---|
| 传输速率极低,ss中rwnd=0频繁出现 | 接收端处理能力不足 | 抓包看ZeroWindow标记 |
| 传输速率不稳,大量重复ACK | 网络丢包导致快重传频繁 | Wireshark统计重复ACK数量 |
| 发送窗口长期很小,cwnd增长缓慢 | 慢启动阈值被压得很低 | ss -ti查看ssthresh |
| 空闲后首次传输明显慢 | tcp_slow_start_after_idle=1 | 检查该内核参数 |
| 高带宽链路利用率低 | BDP大于窗口上限 | 计算BDP与窗口做对比 |
这些现象里,最隐蔽的是第一种。ZeroWindow不是网络问题,但表现起来和网络极慢很像。如果不抓包,可能排查半天方向都是错的。我有一个习惯:只要是吞吐上不去的场景,先抓包,再下结论。抓包能瞬间区分出是接收端瓶颈(大量ZeroWindow)、网络丢包(大量重复ACK和重传)、还是发送端主动限速(cwnd很小且增长慢)。
6.2 使用tcpdump抓包分析要点
如果连Wireshark图形界面都没有,只靠命令行也能排查。用tcpdump抓包,再输出关键信息:
bash复制tcpdump -ni eth0 tcp port 5000 -S -vv
重点看几个指标:
window字段是否经常为零或很小;dup ack数量;retransmission重传是否频繁。
如果重传率超过万分之一,链路质量就很值得怀疑了。高重传率在实时的表现就是TCP把大量窗口给收缩掉,吞吐断崖式下跌,但应用层看来只是“网速慢”,很难直接归因到重传。只有抓包才能量化。
还有一个实用技巧:使用netstat -s查看协议栈级别的统计信息,可以看到重传次数、丢包率、接收缓冲区溢出、窗口收缩次数等汇总数据。这些数字能帮你判断问题是历史累积的偶发问题,还是持续存在的系统性问题。
6.3 高BDP网络的窗口优化
在高带宽高延迟的网络环境(比如跨地区专线、云上大实例之间)中,最容易踩到窗口上限的坑。BDP过高,而窗口上限不足,会导致链路虽然在技术上“是通的”,但实际利用率奇低。
这里有一个真实案例。我曾遇到过一条100Mbps、RTT约120ms的跨地域链路,理论上BDP是:
code复制100 * 10^6 bit/s * 0.12 s = 12 * 10^6 bit = 1.5MB
但服务端的TCP接收窗口配置只用了默认的64KB,实际传输速率被死死的限制在大约4Mbps,利用率只有4%。把接收缓冲区调大到2MB,同时确认窗口缩放因子已协商,传输速率立刻飙升。这个案例里,流量控制就是核心瓶颈,拥塞控制连发挥作用的机会都没有。
但反过来也要警惕另一种情况:如果把窗口调得极其巨大,而链路的丢包率并不理想,拥塞控制会把cwnd不断往下压,结果窗口再大也没有用。窗口调大只是“放宽了上限”,不解决丢包问题。要提升高BDP链路吞吐,核心是降低丢包率、减少重传,必要时使用BBR这类新型拥塞控制算法。
最后再说一个我在日常开发中经常用的检查思路:遇到TCP传输性能问题时,从下往上逐层排查。先看物理链路和MTU,再看丢包率,再看窗口,再看应用层处理速度。很多工程师一上来就怀疑应用层代码,结果抓包一看全是重传和窗口零通告,白白浪费了一整天。TCP性能问题,十有八九都是流量控制或拥塞控制这两个机制在起作用。把这两个机制刻在脑子里,排错速度能翻一倍。
