AI इंटरकनेक्ट और ऑप्टिक्स
AI क्लस्टर GPU को या तो InfiniBand से या हाई-स्पीड Ethernet से जोड़ते हैं। दोनों ऑप्टिक्स को प्रोडक्शन में सबसे तेज़ मॉड्यूल तक धकेलते हैं।
InfiniBand बनाम Ethernet (RoCE)
| InfiniBand | Ethernet + RoCE | |
|---|---|---|
| फ़्लो कंट्रोल | क्रेडिट-आधारित, लॉसलेस | PFC/ECN, लॉसलेस |
| RDMA | नेटिव | RoCEv2 |
| मौजूदा रेट | NDR (400G) | 400G / 800G |
| इकोसिस्टम | HPC-आधारित | व्यापक, मल्टी-वेंडर |
दोनों वैध विकल्प हैं; कई बड़े क्लस्टर InfiniBand इस्तेमाल करते हैं, जबकि बड़े पैमाने पर AI के लिए Ethernet+RoCE तेज़ी से बढ़ रहा है।
रेट और मॉड्यूल
- 400G: QSFP-DD या OSFP, 4×100G या 8×50G लेन से बना।
- 800G: OSFP या QSFP-DD800, आमतौर पर 8×100G लेन।
रेट और लेन की संख्या फ़ॉर्म फ़ैक्टर तय करती है; InfiniBand की जनरेशन और उनकी प्रति-लेन रेट InfiniBand की स्पीड में हैं।
रीच के प्रकार
रैक के अंदर, छोटी दूरी के DR/SR ऑप्टिक्स या डायरेक्ट-अटैच और एक्टिव केबल का बोलबाला है; पंक्तियों के बीच, FR/LR सिंगल-मोड ऑप्टिक्स लंबे हॉप उठाते हैं। हाई डेंसिटी का मतलब है कि एक ही स्विच सैकड़ों ऐसे मॉड्यूल होस्ट कर सकता है।
रीच चाहे जो भी हो, इन मॉड्यूल में मानक प्रबंधित मेमोरी होती है, CodingBox किसी लिंक के फ़ैब्रिक में शामिल होने से पहले उसकी पहचान जानकारी और DDM पढ़कर पुष्टि करता है।