CodingBox 문서

AI 인터커넥트와 광 모듈

AI 클러스터는 InfiniBand 또는 고속 이더넷으로 GPU를 연결합니다. 두 방식 모두 양산되는 가장 빠른 모듈까지 광학 부품을 밀어붙입니다.

InfiniBand와 이더넷(RoCE) 비교

InfiniBand이더넷 + RoCE
흐름 제어크레디트 기반, 무손실PFC/ECN, 무손실
RDMA네이티브RoCEv2
현재 속도NDR(400G)400G / 800G
생태계HPC 기반폭넓은 멀티벤더

둘 다 타당한 선택입니다; 많은 대형 클러스터가 InfiniBand를 사용하는 한편, 이더넷+RoCE는 대규모 AI 영역에서 빠르게 성장하고 있습니다.

속도와 모듈

  • 400G — QSFP-DD 또는 OSFP, 4×100G 또는 8×50G 레인으로 구성.
  • 800G — OSFP 또는 QSFP-DD800, 보통 8×100G 레인.

속도와 레인 수가 폼 팩터를 결정합니다; InfiniBand 세대와 레인당 속도는 InfiniBand 속도에서 다룹니다.

전송 거리 유형

랙 내부에서는 짧은 DR/SR 광학 부품이나 다이렉트 어태치·액티브 케이블이 주로 쓰이고, 열 사이에서는 FR/LR 싱글모드 광학 부품이 더 긴 구간을 담당합니다. 고밀도 환경에서는 스위치 한 대가 이런 모듈을 수백 개까지 수용할 수 있습니다.

전송 거리와 무관하게 이런 모듈들은 표준 관리 메모리를 갖추고 있습니다 — CodingBox는 링크가 패브릭에 합류하기 전에 식별 정보와 DDM을 읽어 검증합니다.


이 문서에서 부정확한 내용이나 오류를 발견하면 해당 부분을 선택하고 Ctrl+Enter를 눌러 해 주세요.