وصلات الربط البيني للذكاء الاصطناعي ووحداتها الضوئية
تصل عناقيد الذكاء الاصطناعي وحدات GPU ببعضها إما عبر InfiniBand أو عبر Ethernet عالي السرعة. وكلاهما يدفع البصريات نحو أسرع الوحدات المتوفرة في الإنتاج.
InfiniBand مقابل Ethernet (RoCE)
| InfiniBand | Ethernet + RoCE | |
|---|---|---|
| التحكم في التدفق | قائم على الرصيد (credit-based)، بلا فقد | PFC/ECN، بلا فقد |
| RDMA | أصلي (native) | RoCEv2 |
| المعدل الحالي | NDR (400G) | 400G / 800G |
| المنظومة | متجذرة في HPC | واسعة، ومتعددة المورّدين |
كلاهما خيار صالح؛ فكثير من العناقيد الكبيرة يستخدم InfiniBand، بينما ينمو Ethernet+RoCE بسرعة لتطبيقات الذكاء الاصطناعي واسعة النطاق.
المعدلات والوحدات
- 400G — QSFP-DD أو OSFP، مبنية من 4×100G أو 8×50G من المسارات.
- 800G — OSFP أو QSFP-DD800، عادة 8×100G من المسارات.
يحدّد المعدل وعدد المسارات عامل الشكل؛ وأجيال InfiniBand ومعدلاتها لكل مسار موجودة في سرعات InfiniBand.
أنواع المدى
داخل الرف، تسود بصريات DR/SR القصيرة المدى أو الكبلات المباشرة التوصيل والنشطة؛ وبين الصفوف، تحمل بصريات FR/LR أحادية النمط القفزات الأطول. والكثافة العالية تعني أن مبدّلًا واحدًا يمكن أن يستضيف مئات هذه الوحدات.
أيًا كان المدى، تحمل هذه الوحدات ذاكرة مُدارة قياسية؛ ويقرأ CodingBox بيانات تعريفها وDDM للتحقق من الوصلة قبل أن تنضم إلى النسيج.