OcNOS AI Fabric: open 800G lossless Ethernet for GPU clusters
OcNOS AI Fabric brings carrier-grade networking to the GPU cluster: a complete lossless Ethernet system. IP Infusion delivers it whole, validated 800G open switches from Edgecore or UfiSpace running OcNOS-DC, supported under one contract, with your NIC, GPU, and switch choices kept open. It carries lossless RoCEv2 RDMA with PFC, ECN-based congestion control (DCQCN), and sub-millisecond DLB in production today. IP InfusionはUltra Ethernet Consortiumの貢献メンバーであり、OcNOS-DCは次に準拠します Ultra Ethernet 1.0 fabric profile.
thousandGPUリファレンスデザイン
アーキテクチャブリーフをダウンロード
Four short downloads that go deeper than this page: the lossless AI fabric architecture, the full OcNOS-DC datasheet, the EVPN-VXLAN data center reference, and next-generation DCI with IPoDWDM.
OcNOS 800G イーサネットベースのロスレス AI ファブリック
Tomahawk 4/5スパイン上のノンブロッキングRoCEv2ファブリック:SKUティア、検証済みプラットフォーム、導入アーキテクチャ。
概要資料を入手EVPN-VXLAN データセンターファブリック
オープンなleaf-spineデータセンターファブリック:EVPN Type-2およびType-5ルート、分散型エニーキャストゲートウェイ、マルチテナントVNIs。
概要資料を入手IPoDWDM による次世代 DCI
トランスポンダ層を集約し、コヒーレントな 400G/800G ZR および ZR+ 光モジュールをルーターから直接運用してデータセンター間接続を実現します。
概要資料を入手OcNOS-DC データシート
OcNOS-DC の完全な仕様。EVPN-VXLAN と Ethernet for AI の機能セット、ソフトウェア SKU、サポート対象ハードウェアプラットフォーム、ソリューション発注ガイドを収録しています。
データシートを入手ジョブ完了時間を左右する要素
スケール時に重要なのは、スイッチのスループットではなく、ジョブがどれだけ速く完了しGPUがどれだけ稼働し続けるか。クラスターが同期のために停止するたびに、アイドル状態のGPUが処理能力を浪費するため、ファブリックは一切パケットを落とさず、輻輳が始まった瞬間に対応する必要がある。
OcNOS-DC exposes every setting, so your team tunes the fabric against your real GPU collective traffic (xCCL: NCCL, RCCL, oneCCL) instead of accepting a vendor's fixed profile. Each pattern below is one way a cluster stalls, and how OcNOS-DC keeps it moving.
→ DLB 1 ミリ秒未満でフローを負荷の低いパスへと切り替えます。
→ GLB is on the OcNOS roadmap to balance across the whole fabric, not just the local hop.
→ DCQCN 何かがあふれる前に、早い段階で送信元を減速させます。
→ PFC watchdog スタックしたポートを自動的に復旧します。
→ Ultra Ethernet(UEC 1.0) 単一のフローをすべてのパスへ同時に分散します。
→ 今日購入するスイッチは、UEC NIC の登場時にも入れ替えなしでそのまま活用可能です。
Where the capacity goes. Static ECMP pins each large flow to one path, so elephant flows collide on a few uplinks while others sit idle. Dynamic load balancing rebinds flows on real-time congestion to keep every uplink busy, so a well-run AI fabric targets utilization in the 90% range on the same switches, with no extra uplinks. OcNOS-DC ships DLB on Tomahawk 4 and 5.
DLB 詳細解説 →800G Spine-Leaf、 エンドツーエンドでロスレス
各チームが熟知するleaf-spine(Clos)設計を、GPUトラフィックを損失なく処理できるよう構築。ルーテッドeBGPアンダーレイがすべての経路にトラフィックを均等分散し、ロスレスな優先度キューがRoCEv2フローを保護、独立した管理ネットワークがスイッチを起動し、テレメトリを単独でストリーミング。チェックポイントおよびデータセット向けのleaf接続NVMe-oFならびにNFSストレージは、GPUラックに隣接して配置。詳細は以下を参照 DC ファブリック for storage-fabric detail. Hover any node for platform, port count, and chip.

ノードにカーソルを合わせると機能とプラットフォームの詳細を表示・・全HCL:40以上の検証済みプラットフォームはこちら ipinfusion.com/hcl
Every GPU NIC on its own rail, scaling across pods
In a rail-optimized fabric each GPU server homes one NIC to each of eight dedicated rail leaves, so the dominant same-rail AllReduce stays on one leaf and only cross-rail traffic reaches the spine. It scales pod by pod on the same 800G Tomahawk 5 switches. See the rail-optimized deep-dive and the full reference topologies.

検証済みのオープンスイッチ
OcNOS-DC は Edgecore および UfiSpace の Broadcom Tomahawk/Trident スイッチ上で動作するため、あらゆるプラットフォームが検証済みで、発注可能かつセカンドソース調達可能です。

Edgecore AIS800-64D
64 x 800G · 51.2 Tbps
QSFP-DD800 · 2x400G/4x200G/8x100Gへのブレイクアウト
Datasheet →
UfiSpace S9321-64E
64 x 800G · 51.2 Tbps
QSFP-DD800 · 2x400G/4x200G/8x100Gへのブレイクアウト
Datasheet →
Edgecore AS9736-64D
64 x 400G · 25.6 Tbps
QSFP56-DD 400G · 4x100G/4x25Gへのブレイクアウト · DAC/AOC
Datasheet →HCL で 40 種類以上の検証済みプラットフォームをすべて見る →
Broadcom Tomahawk と Trident の各ファミリーの違い、そして OcNOS が動作するすべてのオープンスイッチ →
ソフトウェア・ハードウェア・サポートを単一ベンダーが担保
単一の契約、単一の問い合わせ先チーム
IP Infusion との単一の契約で OcNOS-DC ソフトウェアと検証済みのスイッチハードウェアを一括してカバーするため、NOS ベンダーとハードウェアベンダーが分かれることなく、TAC も SLA も一本化されます。Premium および Enterprise ティアでは 24/7 のサポートポータルを利用可能です。
サポート詳細を見るファブリックを一元管理する単一コンソール
IP Maestro は OcNOS 向けのエレメント管理システムです: NETCONF を介して全スイッチのトポロジー、障害、コンフィグレーション、ソフトウェアイメージを扱い、既存の OSS の下位に位置します。大規模なマルチサイトのフリートを一つのコンソールから管理します。
IP Maestro を見るストリーミングテレメトリとゼロタッチ
gNMI ストリーミングテレメトリが Prometheus と Grafana にデータを供給し、DCBX が各サーバーへ正しいロスレス設定を自動的にプッシュし、ゼロタッチプロビジョニングが起動時に構成済みの状態でスイッチを立ち上げます。
自動化を試すNVIDIA Spectrum-X に対する、オープンでマルチベンダーの代替
OcNOS-DC は、複数のオープンハードウェアベンダーによる標準 Ethernet スイッチ上で、ロスレス RoCEv2 の AI ファブリックを一つのサポート契約で稼働させます。AI トレーニングジョブが依存するファブリックメカニズムに対応しつつ、NIC、GPU、ハードウェアの選択を単一ベンダーに固定せずオープンに保ちます。
| 商談を左右する要素 | オープンAIファブリック(Edgecore/UfiSpace上のOcNOS-DC) | クローズドな単一ベンダースタック(NVIDIA Spectrum-X) |
|---|---|---|
| ハードウェア調達 | 複数ベンダーによるオープンなマーチャントシリコン(Edgecore、UfiSpace) | シングルベンダーのスイッチ、NIC、GPU |
| NIC および GPU の選択 | オープン。NICとGPUを個別に交換可能 | NVIDIA NICおよびGPUロードマップと連携 |
| ロスレス RoCEv2 (PFC、ECN、DCQCN) | ✓ details → | ✓ |
| アダプティブロードバランシング | ✓ sub-millisecond DLB flowlet rebinding details → | ✓ (proprietary) |
| PFCデッドロック保護 | ✓ deadlock watchdog with auto-drain details → | ✓ |
| Ultra Ethernet(UEC 1.0) | ✓ tracks the UEC 1.0 fabric profile details → | Aligned; also a UEC contributing member |
| ストリーミングテレメトリと自動化 | ✓ gNMI, OpenConfig, ZTP, DCBX, Ansible | ✓ (vendor pipeline) |
| 単一のサポート契約(スイッチとソフトウェア) | ✓ 1 つの TAC、1 つの SLA | ✓ (single vendor) |
| GPUシリコンバックエンド統合 | 標準の Ethernet。GPU シリコンとのコデザインなし | Advantage NVIDIA: NIC, switch, and GPU co-designed |
| ファブリックコントローラー層 | gNMI テレメトリと、既存の OSS または IP Maestro を通じて管理 | Advantage NVIDIA: integrated fabric-controller layer |
| UEC certification | UEC 1.0ファブリックプロファイルに準拠(認証の主張ではありません) | NVIDIA は UEC のステアリングメンバーです |
NVIDIA、Spectrum-X、Quantum、ConnectX は NVIDIA Corporation の商標です。IP Infusion は NVIDIA と提携しておらず、推奨もしていません。この比較は次で検証可能な OcNOS-DC の機能を反映しています: フィーチャーマトリクス.
OcNOS-DCの位置づけ
2026年までにほぼすべての選択肢が、同じ技術的水準をクリアします:ロスレスRoCEv2、輻輳制御、アダプティブルーティング、Ultra Ethernet準拠。したがって判断は、次に集約されます 取引の形態:オープンなオペレーティングシステムかロックされたスタックか、オープンなハードウェアかロックされたハードウェアか、標準の Ethernet か閉じた InfiniBand か。 Here is where each one leaves you.
各選択肢はそれぞれ異なる優先事項に対応します。OcNOS-DC は、オープンなハードウェア・完全なソリューション・ロックインの排除を強みとします。
GPU ファブリックを数分でサイジング
GPU 数と NIC 速度を入力してください。AI Fabric Design Suite が、leaf-spine トポロジー・スイッチおよびポート数・そのまま見積もりに使える部品表 (BOM) へと対応付けます。スプレッドシートは不要です。
OcNOS をデータセンター全体へ拡張
AI はデータセンターの一領域に過ぎません。同一の OcNOS イメージがコンピュート・ストレージ・リモートサイトへと広がり、同じ NOS・同じ CLI・同じサポートを提供します。
よくあるご質問
AI Fabricリファレンスデザイン
Quick form. Your PDF opens immediately after submit.
✓ PDF を新しいタブで開いています…
開かない場合は、下記のリンクをご利用ください。
OcNOS 800G イーサネットベースのロスレス AI ファブリック
簡単なフォームです。送信後すぐに PDF がダウンロードされます。
✓ PDF を新しいタブで開いています…
開かない場合は、下記のリンクをご利用ください。
EVPN-VXLAN データセンターファブリック
簡単なフォームです。送信後すぐに PDF がダウンロードされます。
✓ PDF を新しいタブで開いています…
開かない場合は、下記のリンクをご利用ください。
IPoDWDM による次世代 DCI
簡単なフォームです。送信後すぐに PDF がダウンロードされます。
✓ PDF を新しいタブで開いています…
開かない場合は、下記のリンクをご利用ください。
OcNOS-DC データシート
簡単なフォームです。送信後すぐに PDF がダウンロードされます。
✓ PDF を新しいタブで開いています…
開かない場合は、下記のリンクをご利用ください。
AIファブリックおよびDC導入
Broadcom Tomahawk 4/5上でOcNOS-DCを運用する、本番AIクラスターおよびデータセンターファブリック。

NTT DATAはIP Infusionと提携し、ディスアグリゲーテッドなオープンネットワーキングソリューションを市場に展開。OcNOS搭載のCell Site Router、Routed…を提供

Scott Dataは、UfiSpace、Edgecore Networks、CelesticaのオープンネットワーキングハードウェアでOcNOSを導入し、全社にわたるレガシーベンダースタックを置き換え…

フランス拠点のデータセンターシステムインテグレーターであるMadeo Consultantは、Cisco NexusおよびCatalystスイッチをEdgecore上のIP Infusion OcNOSに置き換え…

フランスのISPおよびマネージドサービスプロバイダーであるProsoluceは、IP Infusion OcNOSを稼働する100G EVPN-VXLANバックボーンへとコアをアップグレードしました…
ブログの関連記事
AIネットワーク意思決定フレームワーク:速度、ROI、戦略的自由度のためのGPUファブリック
RoCEv2とオープンハードウェアを用いたGPUファブリック選定のためのバイヤー視点のフレームワーク
記事を読む →データセンター向けOcNOS 7.0:AIファブリック、800Gプラットフォーム、大規模EVPN-VXLAN
OcNOS 7.0で提供される800G AIファブリック機能とTomahawk 5プラットフォーム
記事を読む →OcNOS 7.0: What's New for AI, Transport, and Cloud
GPUクラスター向けにPFCを用いたRoCEv2ロスレストランスポートを強調
記事を読む →データセンター向けOcNOS 6.6:AIファブリックPFC/ETS、EVPNポリシー、400G
OcNOS AIファブリック導入を支えるPFC/ETSロスレスDCB機能
記事を読む →OcNOS で AI ファブリック全体を設計
ビジネスケースからポート数の計算まで、構築のどの段階からでも着手できます。
こちらからご連絡いたしましょうか?
ご連絡先をご記入ください。IP Infusionのチームが、AIファブリックの設計をお手伝いいたします。ご希望の場合のみご連絡いたします。