# Meta 开源 MetaRoCE：一套为百万 GPU 级以太网从头设计的 RDMA 传输协议

> 原标题：MetaRoCE：为 AI 规模以太网打造的全新 RDMA 传输协议

- 来源：AI HOT 精选
- 发布时间：2026-08-24T18:02:29.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/52566
- 原文：https://engineering.fb.com/2026/08/24/networking-traffic/metaroce-rdma-transport-ai-ethernet

## 摘要

Meta 通过 OCP 开源了一套全新的 RDMA 传输协议 MetaRoCE，包含规范、参考实现和合规测试套件。它抛弃了传统 RoCE 要求交换机保序、不丢包的假设，把乱序到达、多路径喷洒和拥塞控制都交给网卡处理。每个数据包自带目标地址，数据落地直接写进内存，没有重排缓冲区，也不会出现队头阻塞。Meta 已经在跨区域的数十万 GPU 集群上验证过这套...

## 推荐理由

Meta 把一套重新设计的 RDMA 传输协议开源了，核心是把乱序处理、多路径和拥塞控制都挪到网卡上，不再要求交换机保序不丢包。已经在几十万张 GPU 的跨区域集群上跑过，对大规模训练的基础设施团队有直接参考价值。不过它属于网络层创新，离大多数 AI 应用开发者的日常工作有点远。

## 锐评

Meta 这次开源的不是小修小补，而是把传统 RoCE 依赖交换机保序、不丢包的假设直接推翻了。新协议 MetaRoCE 让每个数据包自带目标内存地址，网卡负责处理乱序到达和多路径喷洒，数据落地直接写进内存，没有重排缓冲区，也不会出现队头阻塞。这个设计思路很干脆：把复杂性从网络设备挪到端侧，用更便宜的以太网交换机就能支撑大规模 AI 集群。

文章说已经在跨区域的数十万 GPU 集群上验证过，对 all-reduce 的尾部延迟和分布式推理的响应时间都有改善。但正文没披露具体的性能对比数字，比如延迟降低了多少百分比、吞吐提升了多少，也没说明和传统 RoCEv2 在同等规模下的量化差异。这点先别太激动，等 OCP 那边放出参考实现和合规测试套件后，第三方跑出来的数据会更有说服力。

还缺一个关键信息：这套协议对网卡硬件有什么要求，现有商用网卡能不能直接适配，还是需要新硅片。如果门槛太高，生态铺开的速度会慢很多。
