AI インターコネクトと光モジュール
AI クラスターは、InfiniBand または高速 Ethernet のいずれかで GPU を接続します。どちらも、実用化されているモジュールの中で最速のものを光学部品に求めます。
InfiniBand と Ethernet(RoCE)
| InfiniBand | Ethernet + RoCE | |
|---|---|---|
| フロー制御 | クレジットベース、ロスレス | PFC/ECN、ロスレス |
| RDMA | ネイティブ | RoCEv2 |
| 現行レート | NDR(400G) | 400G / 800G |
| エコシステム | HPC 由来 | 広範、マルチベンダー |
どちらも有効な選択肢です。多くの大規模クラスターは InfiniBand を使用していますが、大規模 AI 向けには Ethernet+RoCE も急速に伸びています。
レートとモジュール
- 400G:QSFP-DD または OSFP、4×100G または 8×50G レーンで構成。
- 800G:OSFP または QSFP-DD800、通常は 8×100G レーン。
レートとレーン数によってフォームファクターが決まります。InfiniBand の世代とレーンごとのレートについてはInfiniBand の速度を参照してください。
伝送距離のタイプ
ラック内では、短距離の DR/SR 光学部品やダイレクトアタッチケーブル、アクティブケーブルが主流です。列と列の間では、FR/LR のシングルモード光学部品がより長い区間を担います。高密度化により、1台のスイッチが数百個ものモジュールを収容できます。
伝送距離にかかわらず、これらのモジュールは標準的な管理メモリを備えています。CodingBox はその識別情報と DDM を読み取り、ファブリックに組み込む前にリンクを検証します。