AIResearchHardware
تعزيز معدل تدريب نماذج Mixture-of-experts باستخدام نوى الدمج المتقدمة
تمكّن نماذج Mixture-of-experts (MoE) من زيادة سعة نماذج الذكاء الاصطناعي عبر تفعيل مجموعة فرعية فقط من المعاملات لكل رمز. تستكشف NVIDIA نوى دمج متقدمة لتحسين معدل تدريب MoE في أنظمة الذكاء الاصطناعي واسعة النطاق.
أصبحت نماذج Mixture-of-experts (MoE) بسرعة مكونًا أساسيًا في أنظمة الذكاء الاصطناعي الحديثة واسعة النطاق. تُستخدم هذه النماذج على نطاق واسع لأنها تتيح سعة نموذجية أكبر بكثير مع تفعيل مجموعة فرعية فقط من المعاملات لكل رمز، مما يوفر نهجًا لا مثيل له لتوسيع الأداء ضمن ميزانية حسابية عملية. مع استمرار زيادة حجم النماذج، تقدم NVIDIA نوى دمج متقدمة تعزز معدل تدريب MoE، مما يحسن الكفاءة والأداء في تدريب نماذج الذكاء الاصطناعي واسعة النطاق.