→ العودة للأخبار EN
AIHardwareResearch

NVIDIA GB300 NVL72 يسجل رقماً قياسياً عالمياً في تدريب MoE المسبق مع DeepSeek-V3 671B

حقق نظام NVIDIA GB300 NVL72 رقماً قياسياً عالمياً في تدريب نموذج DeepSeek-V3 671B باستخدام تقنية mixture of experts (MoE)، حيث وصل إلى 1,648 تيرافلوب في الثانية لكل وحدة معالجة رسومية، معززاً كفاءة تدريب الذكاء الاصطناعي على نطاق واسع.

1 دقيقة قراءة

تركز تدريب نموذج Frontier المسبق بشكل متزايد على تقنية mixture of experts (MoE)، مما أحدث تحولاً جوهرياً في حدود تدريب الذكاء الاصطناعي على نطاق واسع. مع انخفاض الحسابات المطلوبة لكل وحدة بيانات، أصبحت كفاءة التواصل بين وحدات المعالجة عاملاً حاسماً في مدى قدرة النماذج على التوسع عبر آلاف وحدات معالجة الرسوميات. تمكن نظام NVIDIA GB300 NVL72 من تسجيل رقم قياسي عالمي في تدريب نموذج DeepSeek-V3 671B بسرعة 1,648 تيرافلوب لكل وحدة معالجة، مما يدل على التقدم الشامل في تقنيات الأجهزة والبرمجيات التي تدعم تحسين الأداء وقابلية التوسع للنماذج الضخمة في مجال الذكاء الاصطناعي.

اقرأ من المصدر الأصلي ↗