Definición de redes · RDMA · RoCEv2

¿Qué es una fabric de IA?

Una fabric de IA es la red de back-end de GPU (escalado horizontal) que transporta tráfico RDMA entre GPU durante el entrenamiento y la inferencia distribuidos. It connects every GPU NIC across servers and pods using leaf and spine switches in rail-optimized and Clos topologies, and it runs a lossless Ethernet transport (RoCEv2 with PFC and ECN) so no packet is dropped under load. Because GPUs exchange data in lockstep collectives, the fabric's tail latency sets job completion time. This is the networking sense, not the enterprise "data fabric" used in data management. OcNOS-DC provides this fabric on Broadcom Tomahawk 5 hardware.

RoCEv2transporte Ethernet sin pérdidas
51,2 TbpsTomahawk 5, 64x800G
16,000+GPU, Clos de 3 etapas
OcNOS-DCun solo NOS sobre hardware abierto
Dos significados, una palabra

El sentido de redes, no «data fabric»

Dos campos distintos usan la palabra «fabric». Un data fabric es una arquitectura de software para unificar y gobernar datos en una empresa. Una fabric de IA, el tema de esta página, es una red física: los cables, switches y el transporte que mueven tráfico RDMA entre GPU. Cuando un equipo de infraestructura de IA dice «la fabric fue el cuello de botella», se refiere a esta red, la que decidió cuánto tardó el entrenamiento.

  • Data fabric. Una arquitectura empresarial de gestión de datos para unificar y gobernar datos entre sistemas. Software, no cables.
  • AI fabric. La red física de back-end de GPU que transporta RDMA entre GPU durante el entrenamiento y la inferencia. Esta página trata sobre este significado.
  • Por qué importa. La fabric de IA es la que fija el tiempo de finalización del trabajo, así que se diseña para mantenerse sin pérdidas y cargada de forma pareja.
Cómo se construye la fabric

Rails, Clos y un transporte que no puede descartar

Una fabric de IA es una red leaf-spine (Clos) ajustada para un patrón de tráfico: muchas GPU enviándose grandes flujos entre sí a la vez. Tres elecciones de diseño la definen, y cada una existe para proteger el tiempo de finalización del trabajo.

Topología

Rail-optimized, luego Clos de 3 etapas

Each of a GPU server's 8 NICs connects to its own rail leaf dedicado, de modo que el tráfico dominante de AllReduce del mismo rail se queda en un leaf. Más allá de un solo pod, el diseño se extiende a un Clos de 3 etapas de leaf, spine y super-spine.

Transport

RoCEv2 sin pérdidas

Las GPU mueven datos con RDMA, que rinde mal cuando se descartan paquetes. PFC evita que una cola de switch se desborde y ECN marca los paquetes de forma temprana para que la NIC emisora reduzca la velocidad antes de que ocurra la pérdida. Esa combinación transporta RoCEv2 sobre Ethernet.

Behaviour

Por qué tiene que ser sin pérdidas

OcNOS-DC entrega esta fabric con PFC (incluido sobre L3), ECN, Dynamic ECN, WRED, y balanceo de carga dinámico para mantener cada ruta cargada de forma pareja, porque el flujo de cola decide cuándo termina todo el trabajo.

Dónde encaja esto

Ethernet basta, y el switch fija el techo

La fabric de IA es una red Ethernet hoy. Lo que puede alcanzar lo fija el silicio de switch por debajo y el recuento de GPU para el que diseña.

  • Ethernet basta. RoCEv2 con PFC y ECN ofrece RDMA sin pérdidas sobre hardware estándar y multiproveedor. Meta ha publicado un clúster de entrenamiento de 24.000 GPU construido sobre Ethernet.
  • El switch fija el techo. OcNOS-DC corre sobre plataformas Broadcom Tomahawk 5 (51.2 Tbps, 64x800G) como el Edgecore AIS800-64D y el UfiSpace S9321-64E, la densidad que necesita una fabric de GPU 800G.
  • Diseñe por recuento de GPU. Rail-optimized single pod up to roughly 1,000 GPUs, then a 3-stage Clos to 16,000+ and up to about 65,536 at the fat-tree limit.
Preguntas frecuentes

Preguntas frecuentes sobre qué es una fabric de IA

¿Qué es una AI fabric?
En redes, una fabric de IA es la red de back-end de GPU (escalado horizontal) que transporta tráfico RDMA entre GPU durante el entrenamiento y la inferencia distribuidos. Conecta las NIC de GPU entre cada servidor y pod de modo que una operación colectiva como AllReduce se completa tan rápido como el enlace más lento lo permita. Se construye a partir de switches leaf y spine en topologías rail-optimized y Clos, y ejecuta un transporte Ethernet sin pérdidas (RoCEv2 con PFC y ECN). OcNOS-DC aporta esa fabric sobre hardware Broadcom Tomahawk 5.
¿Es una fabric de IA lo mismo que un data fabric?
No. Son términos distintos que comparten una palabra. Un data fabric es una arquitectura empresarial de gestión de datos para unificar y gobernar datos entre sistemas. Una fabric de IA, en el sentido de redes usado aquí, es una red física de back-end de GPU que mueve tráfico RDMA entre GPU. Esta página trata sobre el significado de redes.
¿Por qué decide la fabric de IA el tiempo de finalización del trabajo?
El entrenamiento de GPU corre en sincronía. Tras cada paso, las GPU intercambian gradientes en un colectivo, y cada GPU espera a que ese intercambio termine antes de que empiece el siguiente paso. Si un enlace se estanca o descarta un paquete, todo el trabajo espera. Como la fabric transporta cada uno de esos intercambios, su latencia de cola, no su promedio, fija cuánto tarda un entrenamiento, y por eso la fabric se diseña para mantenerse sin pérdidas y cargada de forma pareja.
¿Necesito InfiniBand, o basta Ethernet para una fabric de IA?
Ethernet es hoy un transporte de fabric de IA de primera clase. RoCEv2 con PFC y ECN ofrece RDMA sin pérdidas sobre hardware estándar y multiproveedor, y Meta ha publicado un clúster de entrenamiento de 24.000 GPU construido sobre Ethernet. OcNOS-DC ejecuta hoy esa fabric RoCEv2 y se alinea con el perfil de fabric 1.0 del Ultra Ethernet Consortium para la próxima generación de endpoints.

¿Construyendo una fabric de IA? Dimensionémosla juntos.

Díganos la escala de GPU y la carga de trabajo, y un ingeniero de IP Infusion hará los cálculos de topología y puertos con usted sobre hardware abierto Tomahawk 5 con OcNOS-DC.