网络层 开放阅读

Port Speed

Port Speed

概念 ID
port-speed
更新时间
2026-05-29
来源数量
待补

Port Speed

3 秒看懂

Port Speed(端口速率)是网络接口在物理层每秒可传输的最大原始比特数(bit/s),是网络设备能力的“出厂上限”——它决定了单条链路带宽天花板,但不等于应用层实际可用的吞吐量。从RS-232串口的115200波特,到数据中心800G光模块,端口速率的提升一直是AI算力集群“Scale Out”扩展的物理基础,也是判断网络代际(25G→100G→400G→800G)的核心指标。

一句话:端口速率是网络硬件的基因上限,它决定你在物理层“能塞多少货”,但实际运多少还要看协议开销与拥堵。

3 分钟产业解释

在AI产业链中,端口速率是一个“隐形天花板”概念——当人们谈论千卡/万卡GPU集群的训练效率时,瓶颈往往不在GPU算力本身,而在互联网络的端口速率不足导致通信阻塞。

它在AI中的三个关键面孔

  1. GPU互联端口:NVIDIA H100/H200 的 NVLink 双向总带宽为 900 GB/s,NVIDIA B200 则提升至 1.8 TB/s 双向,与 InfiniBand 网卡端口速率(如 NDR 400Gb/s)共同直接决定张量并行(AllReduce)的通信延迟。
  2. 交换机端口:Leaf-Spine 架构中,Leaf 交换机端口需匹配服务器上联速率,若服务器端是 200GbE,而交换机只有 100GbE 端口,则形成速率错配,浪费带宽。
  3. 总线接口:PCIe 5.0 x16 提供约 64 GB/s 单向带宽,是 GPU 与 CPU/NIC 间数据搬移的通道;PCIe 6.0/7.0 的端口速率翻倍将缓解“内存墙”压力。

易混淆概念辨析:端口速率 ≠ 吞吐量。端口速率是物理层的原始比特率(如 100GbE),扣除以太网帧前导码、帧间隙、协议头部以及可能的流控、重传开销后,实际可用吞吐量通常只有 70%-90% 左右(取决于帧大小和协议)。

15 分钟专家深入

1. 波特与比特:历史概念与现代含义

“Port Speed”的溯源概念“波特率”(Baud Rate)与“比特率”(Bit Rate)是理解端口速率的工程基础,二者常被混淆。

  • 波特率:每秒传输的码元(Symbol)数量,一个码元是信号状态的一次变化。这是物理层的“波形变化速率”。
  • 比特率:每秒传输的比特数。

当采用 NRZ(不归零)编码时,每个码元承载 1 个比特,此时“波特率 = 比特率”[来源:CSDN博客];当采用 PAM4(四电平脉幅调制)时,每个码元承载 2 个比特,此时“比特率 = 2 × 波特率”。例如,400G 以太网(及部分 800G 模式)普遍采用 PAM4,在 53.125 Gbaud 的波特率下实现 106.25 Gb/s 的单通道比特率——这就是“端口速率”的物理来源。

串口通信中常见的“115200 波特”,在标准配置(起始位+8数据位+停止位,共10位帧)下,有效数据吞吐仅约 11.52 KB/s,远低于 115.2 kbps 的端口速率[来源:CSDN博客]。这成为“端口速率 vs 有效吞吐”的经典案例。

2. AI 网络中的端口速率等级

网络层级当前主流端口速率下一代目标典型封装/接口
服务器网卡(NIC)100GbE/200GbE400GbE/800GbEQSFP56/QSFP-DD
InfiniBand 网卡NDR 400Gb/sXDR 800Gb/sOSFP/QSFP-DD
Leaf 交换机400GbE800GbEQSFP-DD800
Spine 交换机800GbE1.6TbE多线束/CPO
NVLink(片间)900GB/s (H100/H200)更高代际桥接器/基板

AI 训练集群对端口速率的饥渴来自并行训练通信模式:在 Megatron 张量并行中,每层的前向和反向传播需要 AllReduce 通信,通信量与模型隐层维度的平方成正比;在 MoE(混合专家)模型中,Token 需要跨节点分发(All-to-All)到不同专家。这两种通信模式都对端口速率与尾部延迟极度敏感。

3. 端口速率的瓶颈经济学

当 GPU 计算时间被通信时间侵蚀时,有效算力 MFU(模型浮点利用率)会急剧下降。业界经验法则是:若单次通信时间 > 单次计算时间的 50%,则需升配端口速率或调整并行策略。在实际 8 卡服务器内,GPU 通过 NVLink 互联,端口速率充足(如 900 GB/s);但跨节点时,端口速率骤降至 400GbE/800GbE 级别,差距达 20 倍以上。这正是“Scale Out 带宽瓶颈”的物理根源。

AI 推理场景(如自回归解码)对端口速率的需求相对温和,单次 Token 生成无需大规模 AllReduce,但对延迟抖动更为敏感。


技术原理

原理一:端口速率的物理构成

一条物理端口的速率由三个变量决定:

端口速率 (bit/s) = 通道数 (Lanes) × 单通道速率 (Gb/s per lane)

现代高速 SerDes(串行/解串器)负责将并行数据转为串行高速信号发送。例如:

  • 100GbE PAM4:2 通道 × 53.125 Gb/s = 106.25 Gb/s(含 FEC 后编码开销,可用约 100 Gb/s)
  • 400GbE PAM4:8 通道 × 53.125 Gb/s = 425 Gb/s(实际可用 400 Gb/s,8× 模式)或 4 通道 × 106.25 Gb/s = 425 Gb/s(4× 模式)
  • 800GbE:8×106.25 Gb/s 或 4×212.5 Gb/s(更高符号率)

原理二:信号调制与波特率的关系

   符号(Symbol)          映射                 比特(Bit)
  ┌───────────┐                        ┌─────────────────┐
  │ NRZ    1 │──── 即时电压高/低 ───▶ │    1 bit        │
  │ PAM4   1 │──── 四个电平之一 ───▶ │    2 bits       │
  └───────────┘                        └─────────────────┘

PAM4 的代价是信噪比恶化(眼图开口缩小),需要前向纠错(FEC,如 RS-544 码)来保证误码率(BER)达标。从 PCIe 6.0 开始,PCIe 规范亦引入 PAM4 + FEC + Flit 模式,以在相同通道数下将端口速率从 32 GT/s(PCIe 5.0 NRZ)翻倍至 64 GT/s,并向 128 GT/s(PCIe 7.0)、256 GT/s(PCIe 8.0 规划中)演进[来源:PCI-SIG 官宣/ZOL报道]。

原理三:分层模型下的端口速率与有效吞吐

应用层数据          ← 实际想要的数据
───────────────────────
TCP/IP 头部开销     ← 端口速率不扣除
以太网 MAC 开销     ← 端口速率不扣除
物理层(FEC、编码)   ← 部分端口速率已包含(如 64B/66B 编码将 64B 数据映射为 66 比特在线传输)
───────────────────────
物理介质(光纤/铜缆)  ← 端口速率生效处

原理四:串行端口的波特率计算(经典案例)

以 I2C 400KHz 为例[来源:CSDN博客]:

  • 通信时钟(端口电气速率) = 400KHz
  • NRZ 编码,波特率 = 比特率 = 400K bit/s
  • 一帧数据包占用:7地址+1读写+1ACK+8数据+1ACK=18位,其中仅 8 位是用户数据
  • 有效吞吐 ≈ 8/18 × 400K ≈ 177.8Kbit/s(约 22.2KB/s)

技术演进史

年代里程碑端口速率/关键技术
1960sRS-232 串口≤ 115200 波特(标准),NRZ 编码
1990s以太网 10Base-T10 Mb/s,曼彻斯特编码
2000s千兆以太网(GE)1 Gb/s,5 类铜缆/光纤
2010s万兆以太网(10GE)/40GE10/40 Gb/s,SFP+/QSFP+
201525GE 统一通道速率25.78125 Gb/s per lane(NRZ)
2018100GE(PAM4)商用53.125 Gb/s per lane ×2,引入 PAM4+FEC
2020200G/400G 规模部署8×53G 或 4×106G,PAM4
2022PCIe 5.032 GT/s(NRZ)
2024InfiniBand NDR 400Gb/sNVIDIA Quantum-2 平台使用
2025+800GE/PCIe 6.0 SSD8×106/4×212 或 64 GT/s, PCIe 6.0 SSD 预期达 14 GB/s 读
2028(预期)PCIe 6.0 SSD 主控规模量产,1.6TbE预计 SSD 主控量产
未来PCIe 8.0/1.6TbE+256 GT/s per lane,PAM4,评估新型互连[来源:PCI-SIG]

当下关键转折:从 NRZ 到 PAM4 的转换(约 2018 年后),使端口速率在同一物理介质上翻倍成为可能,但也带来了信号完整性、FEC 延迟等新挑战。


技术路线对比

维度NRZ 编码(传统)PAM4 编码(当前主流)
每符号比特数1 bit/Symbol2 bit/Symbol
波特率需求(相同速率)高(如 100G 需 100Gbaud)低(50Gbaud 即可实现 100Gb/s)
信号完整性要求相对宽松严苛:眼图高度缩至 1/3
误码率(BER)10⁻¹² 量级(未纠错)10⁻⁴ ~ 10⁻⁵ 量级(需 FEC)
前向纠错(FEC)通常无需必需(RS-544 或类似),增加约 100ns~数μs 延迟
代表标准10GE/25GE/PCIe 5.0100GE/200GE/400GE/PCIe 6.0+
在 AI 网络中的优势低延迟(无 FEC 延迟),适合小包/控制面高带宽,适合大包/数据面

量化对比:IEEE 802.3 的 100GbE CR4(4×25G NRZ)与 100GbE CR2(2×50G PAM4)相比,后者用一半的铜缆对数实现相同端口速率,但 PAM4 链路需承受 FEC 引入的额外延迟[来源:行业标准推导,具体延迟值取决于 FEC 实现]。


上下游

上游:物理层 IP/SerDes、光电器件、测试测量

  • SerDes IP 授权商:Cadence、Synopsys、Rambus,提供 112G/224G SerDes IP,是交换芯片和网卡芯片的底层技术来源。
  • 光模块厂商:中际旭创、光迅科技等,将电 SerDes 信号转为光信号,端口速率从 100G 向 800G/1.6T 迁移。
  • 信号完整性 EDA/测试:Keysight、Tektronix 提供误码仪、采样示波器,验证 PAM4 眼图。
  • 高端 PCB/背板:高速板材(松下 Megtron 等)决定信号插损,影响端口速率可达距离。

下游:交换机、网卡、AI 服务器

  • 白盒交换机:Accton、广达、智邦为 Meta/微软/AWS 提供高密度 400G/800G 交换机,端口速率是标书核心参数。
  • 网卡(NIC/DPU):NVIDIA ConnectX-7/8、Intel E810、国产新华三、网迅等,端口速率决定服务器接入带宽。
  • AI 服务器集成:超微、英业达、立讯等组装 GPU 服务器时,必须匹配网卡与 PCIe 交换机速率,防止带宽错配。

供应链瓶颈位置:112G/224G SerDes 物理层 IP 是当前最集中的技术瓶颈区域,全球能提供成熟电 SerDes 方案的厂商不超过 5 家,严重制约 800G/1.6T 端口的商用节奏。


关键指标

1. 端口原始速率 (Raw Port Speed)

单位:Gb/s 或 GT/s。如 400GbE、NVIDIA NDR 400Gb/s(信令速率为 4×106.25 Gb/s PAM4)。来源:[厂商白皮书]。

2. 可用吞吐量 (Effective Throughput)

有效载荷吞吐量 = 端口速率 × (MTU /(MTU + 协议开销))。对于 1500 字节以太网帧,100GbE 单向有效 TCP 吞吐约 90-95 Gb/s;对于 9000 字节 Jumbo Frame,可接近 98 Gb/s。[行业经验值,具体依赖协议栈实现]。

3. 端口密度 (Port Density)

单个交换机芯片支持的最大端口数。如 Broadcom Tomahawk 5 单片支持 64×400GbE = 25.6Tb/s 交换容量,体现端口速率×数量的乘积。

4. 误码率 (BER)

AI 网络要求 BER 在 FEC 纠正后 < 10⁻¹²(约相当于无损),且 FEC 前的原始 BER 必须低于门限(如 PAM4 要求 ~10⁻⁵),否则信号质量不可用。

5. SerDes 功耗 (pJ/bit)

每传输 1 比特消耗的能量,直接影响海量端口下的运营成本(Opex)。100G NRZ 时代约 5-8 pJ/bit,PAM4 112G 目标 ~< 3.5 pJ/bit,可插拔光模块 vs CPO(共封装光学)技术路线之争的核心就是传输功耗战。


供需与市场数据

市场规模

  • 数据中心交换机市场:2025 财年约 320-350 亿美元[行业估算],其中 400GbE+ 端口收入占比预计在 50%-55%,800GbE 端口在 2026 年后加速份额爬坡。
  • 光模块市场:2025 年超 120 亿美元,AI 集群是 800G/1.6T 光模块最大增量需求方[来源:LightCounting/供应链估算]。
  • PCIe 互连市场:PCIe 6.0/7.0 Retimer 芯片将是新增长点,用于长距离高速 PCIe 连接。

供需状态

  • 112G SerDes:供不应求,台积电先进制程(N5/N4)产能和 IP 授权费用均处于高位。
  • 800G 光模块:2026 年进入规模放量,四季度达产率有望超过 70%,DAC(直连铜缆)及有源光缆(AOC)在短距(3m/30m 内)占比高。
  • PCIe 5.0/6.0 Retimer:数据中心 GPU 集群对 PCIe 长距互联需求暴增,Retimer 芯片交期偏长(20-30 周)。

价格趋势

800G 光模块 ASP 在 2026 年预计下降 25%-30%,符合“速率翻番、成本仅增 30%-50%”的行业学习曲线;但 1.6T 光模块在导入初期(2027-2028)仍将存在大幅溢价[来源:供应链估算]。


代表公司与资本映射

一、交换机与交换芯片

  • Broadcom:Tomahawk/Jericho 系列交换芯片,端口速率 400G→800G 演进,是 AI 数据中心核心供应商;通过 NVLink 交换机间接参与 GPU 互联。
  • NVIDIA (Mellanox):提供 InfiniBand (NDR/XDR) 交换机与 ConnectX 网卡,拥有从网络到 GPU 的端到端控盘能力;NVSwitch 将端口速率概念应用于片间互联。
  • 国产交换机:海思(芯片),交换机代工(菲菱科思、共进股份),在国产算力中心中承接交换机端口升级需求。

二、光模块与互联

  • 中际旭创 & 新易盛:全球 800G 光模块主要出货商,深度绑定海外云计算与 AI 客户,端口速率升级是核心驱动力。
  • 天孚通信/光库科技:光引擎、高速光器件,受益于端口速率向单波 200G 演进。
  • Credo/Marvell:DSP 芯片和 Retimer,克服高速端口下的信号衰减,属于“速率越高速,越不可或缺”的环节。

三、PCIe 总线与 SerDes

  • Astera Labs:PCIe 6.0 Retimer 龙头,GPU 集群中每条 NVMe/网卡到 CPU/GPU 的链路都可能需要 Retimer,受端口速率翻倍驱动。
  • Rambus/Cadence/Marvell:SerDes IP 授权商和高速接口芯片商,是端口速率的“底层引擎”。

四、系统集成与路由器

  • Cisco/Arista:高端交换机与路由器,面向超大 AI 数据中心提供 800G 线卡。
  • Digi International:工业物联网串口服务器(如 PortServer TS 系列),传统端口速率(115200 波特/RS-232)与现代网络桥接[来源:JDZJ产品列表]。

资本映射逻辑:产业链研究可拆解“速率翻倍 + 渗透率爬坡”双重变量,如 800G 光模块(2026-2027 放量)、PCIe Retimer(PCIe 6.0 平台切换期),以及拥有 224G SerDes 量产能力的芯片厂。


投资逻辑

核心驱动因子

  1. AI 集群规模与并行度:千卡/万卡集群扩大,端口速率需求从 100G→400G→800G 快速迭代,每代周期缩短至 2-3 年。
  2. PCIe 标准代际升级:PCIe 6.0/7.0 落地促使服务器内部互联“端口速率”翻倍,驱动 Retimer/Redriver/交换芯片升级。
  3. 东数西算/算力中心:新建大型算力中心直接采用 400G/800G 网络架构,跳过低速端口,带来结构性增量。
  4. LPO/CPO 降低功耗:线性驱动可插拔光模块(LPO)减少 DSP 功耗,共封装光学(CPO)进一步集成光电芯片,为超高频端口铺平物理道路,可能颠覆现有光模块商业模式。

风险与挑战

  • 信号完整性极限:224G SerDes 面临物理极限,若铜互连无法支撑,需要 CPO 或硅光替代,技术路线不确定性增加。
  • FEC 延迟累积:多跳交换网络(如 3 层 CLOS 架构)中,若每跳 PAM4 端口引入 100-200ns FEC 延迟,端到端延迟将影响 AllReduce 效率,需要拓扑或协议优化。
  • 投资过度超前:若 AI 集群建设节奏放缓,800G 端口渗透不及预期,可能导致光模块/交换芯片库存积压、价格战。
  • 标准化风险:部分厂商“私有速率”方案(如 NVIDIA 早期 NVLink)可能沿用专利壁垒,限制通用交换机/光模块的市场空间。

投资策略定位

  • 进攻型:在 800GbE 光模块、224G SerDes、PCIe 6.0 Retimer 等前沿端口速率赛道超配。
  • 防守型:关注端口升级带动的配套测试、连接器、散热等后周期环节。
  • 事件驱动:关注 PCI-SIG 规范发布、OFC 展会新速率演示、大型数据中心招标结果。

常见误读纠偏

误读 1:“端口速率等于实际传输速度”

事实:端口速率是物理层的原始比特率,减去以太网帧间距、前导码、帧头、FEC 开销以及 TCP/IP 协议头后,应用层有效吞吐量通常仅为端口速率的 70%-90%。例如 115200 波特串口在“1起始+8数据+1停止”帧格式下,有效数据率仅约 92.16kbps,而非 115.2kbps[来源:CSDN博客]。

误读 2:“波特率就是比特率”

事实:仅在 NRZ(每符号 1 比特)编码下二者数值相等。在 PAM4 编码下,一个符号承载 2 个比特,此时比特率 = 2 × 波特率。当前 200G/400G/800G 以太网均采用 PAM4,因此不能再将“波特率”视为端口速率[来源:SPOTO/CSDN博客]。IoT 设备串行通信常用波特率(115200/9600 等),而现代数据中心内早已升级为多电平高比特率传输。

误读 3:“高端口速率一定能解决 AI 通信瓶颈”

事实:AI 训练的通信瓶颈不仅取决于端口速率,还受限于协议开销(如 RoCEv2 的重传机制)、尾延迟(流水线阻塞)、以及集合通信算法效率。单纯升级端口速率而不优化软件协议栈,可能仅将瓶颈转移至 PCIe 总线或内存侧,造成“端口够快但端到端不达预期”的现象。


学习路径

  1. 入门奠基层:理解波特率、比特率与有效吞吐的区别;阅读 IEEE 802.3 物理层入门材料,弄懂 PAM4 调制的眼图和 FEC 原理。
  2. AI 网络专研:学习 NVIDIA 发布的《A100/H100 NVLink & Networking Whitepaper》,理解 AI 训练对“端口速率×网络拓扑”的联合需求。
  3. 协议深入:研究 RDMA over Converged Ethernet (RoCEv2) 及 InfiniBand 传输层的重传和流控,理解端口误码率如何导致有效吞吐下降。
  4. 物理层仿真实战:使用 Keysight ADS 或 MATLAB SerDes Toolbox,搭建 PAM4 链路仿真,观测不同端口速率、通道损耗下的眼图闭合。
  5. 产业跟踪与验证:关注 OFC、Hot Chips、IEEE 802.3 工作组标准更新,阅读 LightCounting 季度光模块出货报告,对照上市公司的端口速率相关收入确认趋势。

一句话总结

Port Speed 是 AI 算力集群从单机走向分布式万卡互联的物理地基:从 NRZ 到 PAM4,从 100G 到 800G,每一次端口速率翻倍,都牵引着 SerDes、光模块、交换芯片和 PCIe 总线的产业升级,也决定了分布式训练的“有效算力”边界。


延伸阅读与来源

  1. IEEE 802.3bs/dj/cm/ck/df Standard for Ethernet — Amendment: Media Access Control Parameters, Physical Layers, and Management Parameters for 200 Gb/s and 400 Gb/s Operation
  2. PCI-SIG Announces PCIe 8.0 Specification Development — Official Press Release
  3. NVIDIA H100 NVLink and Networking Architecture White Paper
  4. Lightcounting — High-Speed Ethernet Optics Reports
  5. CSDN 波特率、比特率,传输速率,通信速度深度辨析
  6. 思博网络(SPOTO) — 波特率及其重要性学习笔记
  7. 亿佰特物联网 — 波特率的工作原理及作用详解
  8. JMicron/JDZJ — PortServer TS 系列工业串口服务器产品列表

注:以上部分市场数据出自行业估算与供应链渠道,未标注为经审计财报。PCIe 8.0 尚处于早期开发评估阶段,最终规范以 PCI-SIG 发布为准。

source: 公开披露与公开资料整理 本页仅用于产业链学习、信息检索和研究辅助;不构成投资建议,不预测涨跌,不提供买卖、仓位或目标价建议。
完整概念页 复盘 13 节结构 公司投研页 沿产业链找到受益公司 投资课 把概念转成可跟踪模型