Phoenix-VL 1.5 Medium Technical Report
إنّ Phoenix-VL 1.5 Medium هو نموذج تأسيسي متعدد الوسائط واللغات بطبيعته، يمتلك 123 مليار معلمة، وقد تم تكييفه خصيصاً مع سياق سنغافورة من خلال تدريب مسبق ومواءمة محلية مكثفة، محققاً أداءً هو الأفضل في فئته على المعايير المرجعية الإقليمية مع الحفاظ على التنافسية العالمية في الذكاء العام.
البحث الأصلي مرخَّص بموجب CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). هذا شرح مولَّده بالذكاء الاصطناعي للبحث أدناه. لم يكتبه المؤلفون ولم يصادقوا عليه. وللتحقق من الدقة التقنية، يرجى الرجوع إلى البحث الأصلي. اقرأ إخلاء المسؤولية الكامل
إليك شرح للتقرير الفني لـ Phoenix-VL 1.5 Medium، مترجم إلى لغة بسيطة ويومية مع استخدام تشبيهات إبداعية.
الفكرة الكبرى: "خبير محلي" فائق الذكاء
تخيل أن لديك بروفيسوراً عبقرياً جاب العالم ويعرف كل شيء عن العلوم والرياضيات والتاريخ العالمي. هذا هو نموذج Mistral Medium 3.1 الذي بدأ به الباحثون. إنه ذكي للغاية، ولكن إذا سألته عن قانون محلي معين في سنغافورة أو اسم ملعب مشهور في حي "توا بايوه" (Toa Payoh)، فقد يخمّن خطأً أو يعطي إجابة عامة.
Phoenix-VL 1.5 Medium هو ما يحدث عندما تأخذ ذلك البروفيسور الجوال وترسله إلى "معسكر تدريب مكثف للانغماس في سنغافورة" لمدة 12 شهراً. كان الهدف هو إنشاء ذكاء اصطناعي سيادي — عقل رقمي ينتمي لسنغافورة، يفهم ثقافتها وقوانينها الفريدة، ويمكنه العمل بأمان دون الحاجة للبحث في الإنترنت (مثل نظام "معزول عن الشبكة" لا يتواصل مع العالم الخارجي).
وصفة التدريب: كيف فعلوا ذلك؟
لم يقم الباحثون بمجرد إلقاء كومة من الكتب على النموذج، بل استخدموا وصفة طبخ مكونة من أربع خطوات محددة لخبز هذا الذكاء الاصطني الجديد:
- الطبقة الأساسية (التعلم المسبق المستمر):
فكر في هذا كأنك تغذي النموذج بمكتبة متخصصة ضخمة. لقد أعطوه 1 تريليون توكن (الـ "توكن" هو مثل كلمة أو جزء من كلمة) من البيانات. لم تكن مجرد نصوص عشوائية من الإنترنت؛ بل كانت مزيجاً منسقاً يركز بشدة على قوانين سنغافورة، واللغات الإقليمية (مثل الملايو، والتاميل، والصينية)، والثقافة المحلية.
- التشبيه: تخيل البروفيسور وهو يقرأ كل صحيفة سنغافورية، وكل جريدة رسمية حكومية، وكل رواية محلية لمدة عام كامل، مع الحفاظ على معرفته العالمية في نفس الوقت.
- توسيع القراءة الطويلة (السياق الطويل):
علموا النموذج تذكر كميات هائلة من المعلومات في وقت واحد. قاموا بتوسيع "ذاكرته قصيرة المدى" لتستوعب 131,072 توكن (ما يعادل تقريباً حجم رواية سميكة).
- التشبيه: أصبح بإمكان البروفيسور الآن قراءة وثيقة قانونية كاملة مكونة من 500 صفحة في جلسة واحدة، وتذكر التفاصيل من الصفحة الأولى عندما يصل إلى الصفحة 400، دون أن ينسى البداية.
- الضبط الدقيق (التدريب على التعليمات والمجالات):
هنا تعلم النموذج كيف يتصرف. لقد عرضوا عليه أمثلة محددة لكيفية الإجابة على الأسئلة المتعلقة بالسياسات الحكومية السنغافورية وكيفية وصف المشاهد المحلية (مثل وصف "ملعب التنين في توا بايوه" بدلاً من مجرد "ملعب" عام).
- التشبيه: البروفيسور الآن يأخذ دورة في "خدمة العملاء والإتيكيت المحلي". لقد تعلم أنه عندما يسأل سنغافوري عن قانون ما، فإنه يحتاج إلى إجابة دقيقة، وليس تخميناً غامضاً. كما تعلم أيضاً كيفية النظر إلى صور المعالم المحلية ووصفها بدقة.
- اللمسات النهائية (تحسين التفضيلات المباشر عبر الإنترنت):
أخيراً، قام معلمون بشريون بمراجعة إجابات النموذج وترتيبها. إذا كان النموذج ثرثاراً جداً، أو يهلوس (يختلق معلومات)، أو فظاً، قام المعلمون بتصحيحه.
- التشبيه: "بروفة نهائية" حيث يتدرب البروفيسور على الإجابة على الأسئلة، وتقوم لجنة من الحكام بتقديم ملاحظات لهم لضمان أن يكون مفيداً، صادقاً، وآمناً قبل الصعود إلى المسرح.
ما الذي يجعله مميزاً؟
يسلط الورق الضوء على ثلاث قدرات خارقة لهذا النموذج الجديد:
- إنه أسطورة محلية: في الاختبارات المصممة خصيصاً لسنغافورة (مثل معرفة أسماء جميع الوزارات الـ 16 أو فهم قوانين السلامة المحلية)، تفوق هذا النموذج على نماذج أكبر بكثير وأكثر شهرة.
- النتيجة: سجل درجات أعلى من نماذج تحتوي على 400 مليار بارامتر (مثل Llama 4 Maverick) في المعرفة المحلية. وهذا يثبت أن التدريب المحلي العميق أكثر أهمية من مجرد امتلاك عقل أكبر.
- لم ينسَ العالم: هناك خوف شائع من أن تعليم نموذج موضوعاً معيناً يجعله ينسى كل شيء آخر. يزعم البحث أن Phoenix-VL 1.5 Medium حافظ على ذكائه العام؛ فهو لا يزال بارعاً في الرياضيات، والبرمجة، والاستنتاج العام، تماماً مثل النماذج الرائدة الأخرى.
- يرى ويفهم: على عكس النماذج القديمة التي تقرأ النصوص فقط، هذا النموذج "متعدد الوسائط". يمكنه النظر إلى صورة لمشهد شارع في سنغافورة أو مخطط معقد وشرحه ضمن السياق المحلي.
السلامة: فلتر "الصدق"
بنى الباحثون إطار سلامة خاصاً مصمماً وفقاً لقواعد سنغافورة.
- قاعدة "لا تختلق أشياءً": في السياقات القانونية أو الحكومية، اختلاق حقيقة ما هو أمر خطير. تم تدريب النموذج على قول "لا أعرف" بدلاً من التخمين.
- قاعدة "لا للجهات السيئة": النموذج مقاوم لعمليات "كسر الحماية" (الحيل التي يستخدمها الناس لجعل الذكاء الاصطناعي يقوم بأفعال سيئة) ولن يسرب تعليماته السرية.
- التشبيه: فكر فيه كأنه موظف مدني منضبط جداً يعرف بالضبط ما يسمح له بقوله وما يجب أن يرفض الإجابة عنه، مما يضمن عدم كسر القانون أو نشر معلومات مضللة عن طريق الخطأ.
الخلاصة
Phoenix-VL 1.5 Medium هو نموذج ذكاء اصطناعي بـ 123 مليار بارامتر، يثبت أنك لست بحاجة لأكبر نموذج في العالم لتكون الخبير المحلي الأذكى. من خلال تنسيق البيانات بعناية والتدريب خصيصاً لقوانين سنغافورة ولغاتها وثقافتها الفريدة، صنع المبدعون نموذجاً هو:
- واسع المعرفة بشأن سنغافورة (أفضل من العمالقة).
- منافس عالمياً في الذكاء العام.
- آمن ومؤمن للاستخدام في القطاعات الحكومية والخاصة دون الحاجة للإنترنت.
إنه "أصل سيادي"، مما يعني أنه أداة رقمية بُنيت خصيصاً لاحتياجات سنغافورة، مملوكة ومسيطر عليها من قبل الدولة.
غارق في أبحاث مجالك؟
تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.