LegalOne: A Family of Foundation Models for Reliable Legal Reasoning
تقدم هذه الورقة LegalOne، وهي عائلة من النماذج التأسيسية القانونية الصينية التي تحقق أداءً هو الأفضل في فئتها من خلال خط إنتاج تدريبي ثلاثي المراحل يتكون من أخذ العينات المعدلة للمرونة، وتقطير سلسلة الأفكار الوكيل القانوني، والتعلم المعزز المنهجي لتمكين الاستدلال القضائي الموثوق والقابل للتفسير.
البحث الأصلي مرخَّص بموجب CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). هذا شرح مولَّده بالذكاء الاصطناعي للبحث أدناه. لم يكتبه المؤلفون ولم يصادقوا عليه. وللتحقق من الدقة التقنية، يرجى الرجوع إلى البحث الأصلي. اقرأ إخلاء المسؤولية الكامل
إليك شرح لورقة LegalOne البحثية، مترجماً إلى لغة يومية بسيطة باستخدام التشبيهات لجعل المفاهيم التقنية المعقدة سهلة الاستيعاب.
الصورة الكبيرة: لماذا نحتاج إلى LegalOne؟
تخيل أنك وظفت شخصاً موسوعياً عبقرياً ليكون محامياً لك. هذا الشخص (الذي يمثل النماذج اللغوية الكبيرة القياسية) قد قرأ كل كتاب في المكتبة؛ يمكنه كتابة قصيدة، حل مسألة رياضية، والدردشة عن حالة الطقس. ولكن عندما تطلب منه الترافع في قضية محكمة محددة، فإنه غالباً ما يتعثر؛ قد يخترع قوانين غير موجودة (الهلوسة) أو يغفل عن المنطق الصارم والخطوات المتسلسلة التي يتطلبها القاضي.
LegalOne هو عائلة جديدة من نماذج الذكاء الاصطناعي المصممة خصيصاً لإصلاح هذه المشكلة. لا تنظر إليه كـ "موسوعي" يعرف القليل عن كل شيء، بل كـ خريج متخصص من كلية الحقوق تم تدريبه بصرامة ليفكر كقانوني. وتدعي الورقة البحثية أنه من خلال تدريب هذه النماذج بطريقة مختلفة، يمكنها التفوق على نماذج الذكاء الاصطناعي العامة الضخمة، رغم أنها أصغر حجماً وأكثر كفاءة.
خط التدريب المكون من ثلاث مراحل
لم يكتفِ الباحثون بتغذية الذكاء الاصطناعي بمزيد من الكتب القانونية فحسب، بل بنوا مسار تدريب مكوناً من ثلاث مراحل، يشبه برنامج تعليم متخصص لروبوت قانوني.
المرحلة الأولى: مرحلة "التدريب المتوسط" (بناء الأساس)
المشكلة: إذا أخذت ذكاءً اصطناعياً عاماً وأجبرته فجأة على قراءة الوثائق القانونية فقط، فقد ينسى كيفية التحدث باللغة العادية أو يفقد قدرته على التفكير المنطقي في العالم الحقيقي. وهذا ما يسمى بـ "النسيان الكارثي".
الحل: أخذ العينات المعدل حسب المرونة (PAS)
- التشبيه: تخيل طالباً جيداً في الرياضيات ولكنه يحتاج لتعلم الفيزياء المتقدمة. إذا ألقيت به مباشرة في كتاب مليء بالمعادلات المعقدة، فقد يصاب بالذعر وينسى أساسيات الرياضيات.
- كيف يفعلها LegalOne: يستخدم الباحثون مجدولاً ذكياً يسمى PAS. فكر في هذا كـ مدرس خصوصي يعدل صعوبة الواجب المنزلي بناءً على مزاج الطالب وطاقته الحالية.
- عندما يبدأ الذكاء الاصطناعي في "إعادة الإحماء" (بداية التدريب الجديد)، يعطيه المدرس نصوصاً قانونية مألوفة وسهلة (ذات تعقيد منخفض/Perplexity منخفض) للحفاظ على استقراره.
- ومع ازدياد قوة الذكاء الاصطناعي، يقوم المدرس تدريجياً بإدخال نصوص قانونية أصعب وأكثر تعقيداً.
- والأهم من ذلك، يحتفظ المدرس دائماً بكمية صغيرة من المواد "السهلة" في المزيج لضمان عدم نسيان الذكاء الاصطناعي لمهاراته الأصلية.
- النتيجة: يبني الذكاء الاصطناعي أساساً قوياً ومستقراً من المعرفة القانونية دون فقدان ذكائه العام.
المرحلة الثانية: الضبط الدقيق الخاضع للإشراف (تعلم التفكير كقانوني)
المشكلة: الوثائق القانونية الحقيقية (مثل الأحكام القضائية) غالباً ما تُكتب في شكل ملخصات. فهي تذكر ما قرره القاضي، لكنها غالباً ما تتجاهل عملية التفكير المتسلسلة والمعقدة التي استخدمها القاضي للوصول إلى تلك النتيجة. إذا عرضت على الذكاء الاصطناعي هذه الملخصات فقط، فإنه سيتعلم تخمين الإجابة دون فهم المنطق.
الحل: استخلاص سلسلة الأفكوت الوكيل القانوني (LEAD)
- التشبيه: تخيل أنك تحاول تعلم الطبخ من خلال قراءة بطاقة الوصفة النهائية فقط. أنت تعرف المكونات والطبق، لكنك لا تعرف كيف تقطع البصل أو متى تقلب اللحم.
- كيف يفعلها LegalOne: أنشأوا نظاماً يسمى LEAD يعمل مثل فريق من الطهاة الخبراء (الوكلاء) الذين يعملون معاً.
- بدلاً من مجرد قراءة وصفة، يشاهد الذكال الاصطناعي "برنامج طبخ" حيث يقوم الطهاة بتفكيك العملية: "أولاً، ابحث عن الوقائع. ثانياً، ابحث عن القاعدة. ثالثاً، طبق القاعدة. وأخيراً، قرر النتيجة".
- يتعلم الذكاء الاصطناعي توليد هذه مسارات الاستدلال خطوة بخطوة (سلسلة الأفكار/Chain-of-Thought) من تلقاء نفسه، بدلاً من مجرد حفظ الإجابة النهائية.
- لديهم أيضاً خطوة "ضبط جودة" حيث يقوم قاضٍ رفيع المستوى (ذكاء اصطناعي آخر) بفحص العمل للتأكد من أن المنطق سليم وأن الحقائق دقيقة قبل أن يتعلم منه الذكاء الاصطناعي الطالب.
- النتيجة: يتعلم الذكاء الاصطناعي عملية الاستدلال القانوني، وليس مجرد الإجابات.
المرحلة الثالثة: التعلم المعزز (معسكر تدريب "العقلية القانونية")
المشكلة: حتى مع وجود استدلال جيد، قد يكون الذكاء الاصطناعي مسرفاً في الكلام، أو غامضاً جداً، أو يرتكب قفزات منطقية صغيرة. إنه يحتاج إلى الانضباط.
الحل: منهج التعلم المعزز متعدد المراحل
- التشبيه: فكر في هذا كـ معسكر تدريب عسكري لعقل الذكاء الاصطناعي. يبدأ التدريب سهلاً ثم يزداد صعوبة، لتعليم الذكاء الاصطناعي أن يكون دقيقاً وفعالاً.
- المستوى 1 (الحفظ): يجب على الذكاء الاصطناعي تسميع القوانين بدقة تامة. لا مجال للتخمين.
- المستوى 2 (التطبيق): يجب على الذكاء الاصطناعي تطبيق تلك القوانين على وقائع محددة.
- المستوى 3 (الاستدلال المعقد): يجب على الذكاء الاصطناعي حل قضايا صعبة ومتعددة الخطوات.
- نظام المكافأة: يحصل الذكاء الاصطناعي على "نقاط" (مكافآت) لكونه دقيقاً ومنطقياً. وإذا هلوس أو خرج عن الموضوع، فإنه يخسر النقاط.
- النتيجة: يتطور الذكاء الاصطناعي من مجرد "مطابق للأنماط" (يخمن بناءً على كلمات متشابهة) إلى مستدل مستقل ينتج حججاً قانونية موجزة ومهنية وموثوقة.
النتائج: صغير ولكن قوي
تقدم الورقة البحثية نتيجة مفاجئة: الحجم ليس كل شيء.
- التشبيه: عادةً في عالم الذكاء الاصطناعي، كلما كان أكبر كان أفضل (مثل مكتبة ضخمة مقابل رف كتب صغير). لكن LegalOne يشبه موسوعة قانونية مدمجة وعالية التخصص.
- الادعاء: نموذج LegalOne-8B (الذي يحتوي على 8 مليارات معلمة/parameter) يؤدي بشكل أفضل من أو يضاهي النماذج العامة الضخمة (مثل GPT-4o أو النماذج التي تحتوي على مئات المليارات من المعلمات) في الاختبارات القانونية.
- الكفاءة: يحقق هذا "التفوق" ليس من خلال كونه ضخماً، بل من خلال امتلاكه "كثافة معرفية" أعلى. فهو يعرف بالضبط ما يحتا-جه للقانون، دون حشو زائد.
ماذا أطلقوا للجمهور؟
لمحت الفريق لمجرد الاحتفاظ بالسر، بل أطلقوا:
- أوزان LegalOne (Weights): النماذج المدربة فعلياً ليتمكن الآخرون من استخدامها.
- LegalKit: مجموعة أدوات (مثل اختبار معياري) لقياس مدى جودة أداء نماذج الذكاء الاصطناعي الأخرى في المجال القانوني.
الملخص
LegalOne هو عائلة من نماذج الذكاء الاصطناعي التي تثبت أنك لا تحتاج إلى عقل "عملاق" لتكون محامياً بارعاً. من خلال استخدام عملية تدريب ذكية مكونة من ثلاث مراحل (تثبيت الأساس، تعليم المنطق خطوة بخطوة، والتدريب من أجل الدقة)، نجحوا في إنشاء نموذج يفكر ويستدل ويجادل كمهني قانوني، متفوقاً على نماذج الذكاء الاصطناعي العامة الأكبر بكثير في قاعة المحكمة.
غارق في أبحاث مجالك؟
تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.