CodingBox ドキュメント

AI インターコネクトと光モジュール

AI クラスターは、InfiniBand または高速 Ethernet のいずれかで GPU を接続します。どちらも、実用化されているモジュールの中で最速のものを光学部品に求めます。

InfiniBand と Ethernet(RoCE)

InfiniBandEthernet + RoCE
フロー制御クレジットベース、ロスレスPFC/ECN、ロスレス
RDMAネイティブRoCEv2
現行レートNDR(400G)400G / 800G
エコシステムHPC 由来広範、マルチベンダー

どちらも有効な選択肢です。多くの大規模クラスターは InfiniBand を使用していますが、大規模 AI 向けには Ethernet+RoCE も急速に伸びています。

レートとモジュール

  • 400G:QSFP-DD または OSFP、4×100G または 8×50G レーンで構成。
  • 800G:OSFP または QSFP-DD800、通常は 8×100G レーン。

レートとレーン数によってフォームファクターが決まります。InfiniBand の世代とレーンごとのレートについてはInfiniBand の速度を参照してください。

伝送距離のタイプ

ラック内では、短距離の DRSR 光学部品やダイレクトアタッチケーブル、アクティブケーブルが主流です。列と列の間では、FRLR のシングルモード光学部品がより長い区間を担います。高密度化により、1台のスイッチが数百個ものモジュールを収容できます。

伝送距離にかかわらず、これらのモジュールは標準的な管理メモリを備えています。CodingBox はその識別情報と DDM を読み取り、ファブリックに組み込む前にリンクを検証します。


この記事に不正確な点や誤りを見つけた場合は、該当する箇所を選択して Ctrl+Enter を押すと、できます。