← أحدث الأبحاث
💻 computer science

Yuan3.0 Ultra: A Trillion-Parameter Enterprise-Oriented MoE LLM

تقدم هذه الورقة البحثية Yuan3.0 Ultra، وهو نموذج لغوي كبير مفتوح المصدر بنظام "خليط الخبراء" (Mixture-of-Experts) يضم تريليون معلمة، يستخدم خوارزمية مبتكرة لتقليم الخبراء المتكيف مع الطبقات (Layer-Adaptive Expert Pruning) لتحسين كفاءة ما قبل التدريب بشكل كبير وتقليل حجم النموذج مع تحقيق أداء رائد في المعايير الموجهة للمؤسسات.

المؤلفون الأصليون: YuanLab. ai, :, Shawn Wu, Jiangang Luo, Darcy Chen, Sean Wang, Louie Li, Allen Wang, Xudong Zhao, Tong Yu, Bach Li, Joseph Shen, Gawain Ma, Jasper Jia, Marcus Mao, Claire Wang, Hunter He, Carol Wang
نُشر 2026-03-06
📖 4 دقيقة قراءة☕ قراءة في استراحة قهوة

المؤلفون الأصليون: YuanLab. ai, :, Shawn Wu, Jiangang Luo, Darcy Chen, Sean Wang, Louie Li, Allen Wang, Xudong Zhao, Tong Yu, Bach Li, Joseph Shen, Gawain Ma, Jasper Jia, Marcus Mao, Claire Wang, Hunter He, Carol Wang, Zera Zhang, Jason Wang, Chonly Shen, Leo Zhang, Logan Chen, Qasim Meng, James Gong, Daniel Zhao, Penn Zheng, Owen Zhu

البحث الأصلي مرخَّص بموجب CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). هذا شرح مولَّده بالذكاء الاصطناعي للبحث أدناه. لم يكتبه المؤلفون ولم يصادقوا عليه. وللتحقق من الدقة التقنية، يرجى الرجوع إلى البحث الأصلي. اقرأ إخلاء المسؤولية الكامل

تخيل أنك تدير مطبخاً ضخماً وعالي التقنية مصمماً لطهي ملايين الوجبات المختلفة (الإجابات على الأسئلة) لسلسلة مطاعم ضخمة (عالم الشركات).

في الماضي، كانت هذه المطابخ تواجه مشكلة: كانت توظف 1,000 طباخ (خبراء) للعمل في المطبخ، ولكن لكل طلب، كان طباخان اثنان فقط يقومان بالطهي فعلياً. المشكلة هي أن مدير المطبخ (موجه الذكاء الاصطنا-الـ Router) كان يستمر في إرسال الطلبات إلى نفس الـ 50 طباخاً المشهورين، بينما كان الـ 950 الآخرون واقفين بلا حراك، يحدقون في الجدار. هذا أدى إلى هدر الأموال (على الرواتب/قوة الحوسبة) وأبطأ عمل المطبخ بأكمله لأن الطهاة المشغولين كانوا مثقلين بالأعباء، بينما كان الطهاة العاطلون عن العمل مجرد مساحة ضائعة.

Yuan3.0 Ultra هو تصميم مطبخ جديد وأكثر ذكاءً يحل هذه المشكلة باستخدام تقنية تسمى تقليم الخبراء المتكيف مع الطبقات (LAEP).

إليك كيف يعمل ذلك، مقسماً إلى مفاهحات بسيطة:

1. مشكلة "الطباخ المشغول مقابل الطباخ العاطل"

في الطريقة القديمة لبناء الذكاء الاصطناعي (خليط الخبراء - Mixture-of-Experts)، يكون النظام مثل فريق ضخم من المتخصصين.

  • المشكلة: أثناء التدريب، يصبح الذكاء الاصطناي كسولاً بطبيعته. فهو يتعلم الاعتماد على عدد قليل من "الطهاة الخارقين" الذين يجيدون كل شيء، بينما يتجاهل مئات الطهاة الآخرين الذين لا يحصلون على فرصة للطهي أبداً.
  • النتيجة: المطبخ ضخم، ومكلف، وغير فعال. أنت تدفع رواتب لـ 1,000 طباخ ولكنك تستخدم 50 منهم فقط بفعالية.

2. الحل: LAEP (المدير الذكي)

قدم الباحثون مديراً جديداً يسمى LAEP. بدلاً من الانتظار حتى يتم بناء المطبخ بالكامل ليعمل على طرد الموظفين (وهو ما تفعله الشركات الأخرى)، يقوم LAEP بمراقبة المطبخ أثناء بنائه.

  • المرحلة الأولى: المراقبة. في الأيام الأولى، يكون المطبخ فوضووياً. الطهاة يتحركون بشكل عشوائي.
  • المرحلة الثانية: النمط. بعد فترة، يظهر نمط معين. يلاحظ المدير أن الطباخ رقم 42 مزدحم دائماً، لكن الطهاة من رقم 800 إلى 900 لم يلمسوا مقلاة منذ أسابيع.
  • المرحلة الثالثة: القطع. يقول LAEP: "نحن لا نحتاج إلى هؤلاء الـ 100 طباخ العاطلين". فيقوم بطردهم (تقليمهم) ويعيد تنظيم الطهاة المتبقين بحيث يتم توزيع عبء العمل بشكل مثالي.
  • السحر: من خلال طرد الطهاة غير المفيدين أثناء التدريب، يصبح المطبخ أصغر بنسبة 33% (مما يوفر مبالغ ضخمة من المال والمساحة) ولكنه في الواقع أسرع بنسبة 49% لأن الطهاة المتبقين لا يتصارعون على المساحة أو ينتظرون الطلبات.

3. الترقية "للتفكير السريع" (RIRM)

بمجرد بناء المطبخ، أراد الفريق التأكد من أن الطهاة لا يبالغون في التفكير في وصفاتهم.

  • المشكلة: أحياناً، عندما يُسأل الذكاء الاصطناعي سؤالاً رياضياً صعباً، يبدأ في "التفكير بصوت عالٍ" لمدة 20 دقيقة، ويكتب 50 صفحة من الملاحظات قبل إعطاء الإجابة. هذا ما يسمى "الإفراط في التفكير".
  • الحل: أضافوا قاعدة جديدة تسمى تثبيط التأمل (RIRM). تخيل الأمر كأن رئيس طهاة صارم ينقر على كتف الطباخ ويقول له: "توقف عن الكتابة! لقد فكرت في هذا بما يكفي. أعطني الإجابة الآن".
  • النتيجة: أصبح الذكاء الاصطناعي أسرع بكثير. لا يزال يحصل على الإجابة الصحيحة، لكنه يتوقف عن الإطالة. لقد قلل "وقت التفكير" بنسبة 14% وحسن الدقة بنسبة 16%.

4. لماذا يهم هذا الأعمال (الشركات)

معظم نماذج الذكاء الاصطناعي بارعة في كتابة القصائد أو الدردشة، لكنها تعاني مع المهام التجارية المملة والمعقدة مثل:

  • قراءة عقد مكون من 50 صفحة والعثور على التفاصيل الدقيقة.
  • تحليل جدول بيانات فوضوي للعثور على اتجاه معين.
  • تحويل طلب بلغة طبيعية ("أظهر لي المبيعات للربع الأخير") إلى استعلام قاعدة بيانات معقد.

Yuan3.0 Ultra مصمم خصيصاً لهذه المهام. ولأنه تم تدريبه باستخدام "المدير الذكي" (LAEP) و"رئيس الطهاة الصارم" (RIRM)، فهو:

  • أسرع: يعالج البيانات بسرعة أكبر.
  • أذكى: يتعامل مع المستندات والجداول المعقدة بشكل أفضل من أي نموذج آخر تقريباً.
  • أرخص: لأنه أصغر وأكثر كفاءة، فإن تكلفة تشغيله أقل.

الخلا ملخص

فكر في Yuan3.0 Ultra كآلة أعمال رشيقة وفعالة. لقد أخذوا نموذج ذكاء اصطناعي ضخم ومتضخم، وطردوا الموظفين الكسالى، وأعادوا تنظيم الفريق لتحقيق أقصى قدر من الكفاءة، وعلموهم التوقف عن الإفراط في التفكير. النتيجة هي نموذج أصغر، وأسرع، وجيد للغاية في القيام بالأعمال الشاقة المطلوبة في عالم الأعمال الحقيقي.

غارق في أبحاث مجالك؟

تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.

جرّب Digest →