OcNOS AI Fabric:用于 GPU 集群的开放 800G 无损以太网
OcNOS AI Fabric 将运营商级网络能力带入 GPU 集群:一套完整的无损以太网系统。IP Infusion 以 OcNOS Systems 的形式整体交付:来自 Edgecore 或 UfiSpace、运行 OcNOS-DC 的已验证 800G 开放交换机,由一份支持合同覆盖,同时保持您在 NIC、GPU 和交换机上的选择开放。它已在生产环境中承载基于 PFC、基于 ECN 的拥塞控制(DCQCN)和亚毫秒级 DLB 的无损 RoCEv2 RDMA。IP Infusion 是 Ultra Ethernet Consortium 的成员。
下载架构简报
四份比本页更深入的简短下载资料:无损 AI fabric 架构、完整 OcNOS-DC 数据手册、EVPN-VXLAN 数据中心参考设计,以及基于 IPoDWDM 的新一代 DCI。
OcNOS 800G 以太网无损 AI 网络
基于 Tomahawk 4/5 spine 的无阻塞 RoCEv2 网络:SKU 层级、经验证平台与部署架构。
获取简报EVPN-VXLAN 数据中心网络
开放的leaf-spine数据中心架构:EVPN Type-2和Type-5路由、分布式anycast网关、多租户VNIs。
获取简报基于 IPoDWDM 的下一代 DCI
省去转发器层:直接在路由器上运行相干 400G ZR 与 ZR+ 或 800G ZR 光模块,实现数据中心互连。
获取简报OcNOS-DC 数据手册
完整的 OcNOS-DC 规格:EVPN-VXLAN 与 Ethernet for AI 功能集、软件 SKU、支持的硬件平台,以及解决方案订购指南。
获取数据手册哪些因素决定任务完成时间
在大规模场景下,真正重要的是任务完成的速度和 GPU 的利用率,而不是交换机吞吐量。每当集群暂停以进行同步时,空闲的 GPU 就会浪费算力,因此架构必须做到零丢包,并在拥塞刚出现的瞬间就作出响应。
OcNOS-DC 开放所有设置,您的团队可以根据真实的 GPU 集合通信流量(xCCL:NCCL、RCCL、oneCCL)调优 fabric,而不必接受厂商的固定配置。下面每种模式都是集群停滞的一种原因,以及 OcNOS-DC 如何保持其持续运行。
→ DLB 在一毫秒内将流量切换至更空闲的路径。
→ GLB 在 OcNOS 7.1 中可在整个 fabric 范围内实现均衡,而不仅限于本地一跳。
→ DCQCN 在任何缓冲区溢出之前,就提前减缓发送端速率。
→ PFC watchdog 可自动清除卡滞的端口。
→ DLB 在您当前运行的 RoCEv2 fabric 上,将 flowlet 从繁忙路径上移开。
→ Ultra Ethernet(UEC) 是一种多路径传输,从支持 UEC 的 NIC 将一条流分散到多条路径上。
容量的去向。 静态 ECMP 将每条大流固定在一条路径上,导致大象流在少数上行链路上冲突,而其他链路闲置。动态负载均衡根据实时拥塞重新绑定流量,使每条上行链路保持繁忙,因此运行良好的 AI fabric 可在相同交换机上将利用率目标设在 90% 区间,无需额外上行链路。OcNOS-DC 在 Tomahawk 4 与 5 上提供 DLB。
DLB 深度解析 →800G 脊叶架构, 端到端无损
这正是您团队已经熟悉的叶脊(Clos)设计,专为无损运行 GPU 流量而构建:路由式 eBGP 底层将流量均匀分散到每一条路径上,无损优先级队列保护 RoCEv2 流,独立的管理网络则自行启用交换机并流式传输遥测数据。用于检查点与数据集、挂接于叶节点的 NVMe-oF 与 NFS 存储紧邻 GPU 机架;请参见 DC 网络 了解存储 fabric 详情。将鼠标悬停在任一节点上可查看平台、端口数量与芯片。

悬停节点以查看能力与平台详情 · 完整 HCL:40+ 款已验证平台,位于 ipinfusion.com/hcl
每块 GPU NIC 独占一条 rail,可跨 pod 扩展
在 rail 优化 fabric 中,每台 GPU 服务器分别将一块 NIC 连接到八台专用 rail leaf 中的每一台,因此占主导的同 rail AllReduce 流量停留在一台 leaf 上,只有跨 rail 流量才会到达 spine。它可在相同的 800G Tomahawk 5 交换机上逐个 pod 扩展。请参阅 rail 优化深入解析 以及完整的 参考拓扑.

经验证的开放交换机
OcNOS-DC 运行于来自 Edgecore 与 UfiSpace 的 Broadcom Tomahawk 和 Trident 交换机之上,因此每个平台都经过验证、可下单采购并具备第二货源。

Edgecore AIS800-64D
64 x 800G · 51.2 Tbps
QSFP-DD800 · 拆分为 2x400G / 4x200G / 8x100G

UfiSpace S9321-64E
64 x 800G · 51.2 Tbps
QSFP-DD800 · 拆分为 2x400G / 4x200G / 8x100G

Edgecore AS9736-64D
64 x 400G · 25.6 Tbps
QSFP56-DD 400G · 拆分为 4x100G / 4x25G · DAC / AOC
Broadcom Tomahawk 与 Trident 系列有何不同,以及 OcNOS 运行的所有开放交换机 →
OcNOS Systems:软件、硬件与支持均由同一家厂商负责
一份合同,一个团队响应
以 OcNOS Systems 形式采购时,fabric 只需一份 IP Infusion 合同即可同时涵盖 OcNOS-DC 软件与经过验证的交换机硬件,因此只需对接一个 TAC 和一份 SLA,无需分别面对 NOS 与硬件供应商。Premium 与 Enterprise 等级提供 24/7 支持门户。
查看支持详情统一管理 fabric 的单一控制台
IP Maestro 是面向 OcNOS 的网元管理系统:通过 NETCONF 管理每台交换机的拓扑、故障、配置和软件镜像,位于您现有 OSS 之下。从一个控制台管理大型多站点设备群。
了解 IP Maestro面向 NVIDIA Spectrum-X 的开放、多厂商替代方案
OcNOS-DC 在来自多家开放硬件厂商的标准以太网交换机上运行无损 RoCEv2 AI fabric,以 OcNOS Systems 形式采购时由一份支持合同覆盖。它匹配 AI 训练作业所依赖的 fabric 机制,同时使 NIC、GPU 和硬件的选择保持开放,而非锁定于单一厂商。
| 决定成交的因素 | 开放式 AI Fabric(运行于 Edgecore / UfiSpace 上的 OcNOS-DC) | 封闭的 NIC 加交换机堆栈 |
|---|---|---|
| 硬件采购 | 来自多家厂商的开放通用芯片(Edgecore、UfiSpace) | 单一厂商交换机、NIC 与 GPU |
| NIC 和 GPU 选择 | 开放:可独立更换 NIC 与 GPU | NIC 与 GPU 路线图受制于一家厂商 |
| 无损 RoCEv2(PFC、ECN、DCQCN) | ✓ 详情 → | ✓ |
| 自适应负载均衡 | ✓ 亚毫秒级 DLB flowlet 重绑定 详情 → | ✓ (专有) |
| PFC 死锁保护 | ✓ 带自动排空的死锁 watchdog 详情 → | ✓ |
| 流式遥测与自动化 | ✓ gNMI, OpenConfig, ZTP, DCBX, Ansible | ✓ (厂商流水线) |
| 单一支持合同(交换机与软件) | ✓ OcNOS Systems:一个 TAC,一个 SLA | ✓ (单一厂商) |
| GPU 芯片后端集成 | 标准以太网;无 GPU 芯片协同设计 | NIC、交换机与 GPU 由同一家厂商协同设计 |
| Fabric 控制器层 | 通过 gNMI 遥测以及您的 OSS 或 IP Maestro 进行管理 | 厂商集成的 fabric 控制器层 |
NVIDIA 和 Spectrum-X 是 NVIDIA Corporation 的商标。IP Infusion 与 NVIDIA 无关联,也不为 NVIDIA 背书;本比较反映的 OcNOS-DC 能力可在以下资料中核实: 功能矩阵.
OcNOS-DC 的定位
OcNOS-DC 达到了 2026 年大多数 AI fabric 方案共有的技术标准:无损 RoCEv2、拥塞控制与自适应路由。因此决策最终归结为 合作条款的形态:开放的操作系统还是封闭的技术栈,开放的硬件还是封闭的硬件,标准 Ethernet 还是封闭的 InfiniBand。 Here is where each one leaves you.
每种方案的侧重点各不相同。OcNOS-DC 的优势在于开放硬件、完整方案以及无锁定。
数分钟内完成 GPU fabric 规模规划
输入 GPU 数量与 NIC 速率。AI Fabric Design Suite 会据此生成 leaf-spine 拓扑、交换机与端口数量,以及可直接用于询价的物料清单。无需电子表格。
将 OcNOS 扩展至整个数据中心
AI 只是数据中心的一个环节。同一套 OcNOS 镜像可延伸至计算、存储与远端站点:同一 NOS、同一 CLI、同一支持体系。
常见问题
OcNOS 800G 以太网无损 AI 网络
简短表单。提交后 PDF 将立即开始下载。
✓ 正在新标签页中打开您的 PDF……
如果未能自动打开,请使用下方链接。
EVPN-VXLAN 数据中心网络
简短表单。提交后 PDF 将立即开始下载。
✓ 正在新标签页中打开您的 PDF……
如果未能自动打开,请使用下方链接。
基于 IPoDWDM 的下一代 DCI
简短表单。提交后 PDF 将立即开始下载。
✓ 正在新标签页中打开您的 PDF……
如果未能自动打开,请使用下方链接。
AI fabric 与 DC 部署
在 Broadcom Tomahawk 4/5 上运行 OcNOS-DC 的生产级 AI 集群与数据中心 fabric。

NTT DATA 与 IP Infusion 合作将开放网络解决方案推向市场,提供基于 OcNOS 的基站路由器、Routed Optical…

Scott Data 采用来自 UfiSpace、Edgecore Networks 与 Celestica 的开放网络硬件部署 OcNOS,替换了其原有的传统厂商堆栈……

Madeo Consultant 是一家位于法国的数据中心系统集成商,已用 IP Infusion OcNOS 替换了运行于 Edgecore 上的 Cisco Nexus 与 Catalyst 交换机……

Prosoluce 是一家法国 ISP 及托管服务提供商,已将其核心网升级为运行 IP Infusion OcNOS 的 100G EVPN-VXLAN 骨干网……
博客相关内容
AI 网络决策框架:兼顾速度、ROI 与战略自由的 GPU Fabric
面向采用 RoCEv2 与开放硬件的 GPU fabric 决策的买方侧框架
阅读全文 →面向数据中心的 OcNOS 7.0:AI Fabric、800G 平台、大规模 EVPN-VXLAN
OcNOS 7.0 中交付的 800G AI fabric 功能与 Tomahawk 5 平台
阅读全文 →OcNOS 7.0:AI、传输与云方面的新功能
重点介绍面向 GPU 集群、采用 PFC 的 RoCEv2 无损传输
阅读全文 →面向数据中心的 OcNOS 6.6:AI Fabric PFC/ETS、EVPN 策略、400G
支撑 OcNOS AI fabric 部署的 PFC/ETS 无损 DCB 功能
阅读全文 →用 OcNOS 设计整张 AI fabric
从商业论证到端口数量测算,无论您进行到哪一步,都可从此接续。
需要我们联系您吗?
请留下您的联系方式,IP Infusion 团队将很乐意帮助您设计 AI 网络架构。我们仅在您希望时才会与您联系。