← أحدث الأبحاث
💬 NLP

Top-b: Entropic Regulation of Relative Probability Bands in Autoregressive Language Processes

تقدم هذه الورقة البحثية "Top-b"، وهي استراتيجية فك ترميز مبتكرة تعمل على ضبط عرض نطاق عينة المرشحين ديناميكيًا بناءً على إنتروبيا شانون اللحظية لتحسين المقايضة بين التوليد الإبداعي والاستدلال المنطقي، مما يقلل من تباين فك الترميز البيني مع الحفاظ على دقة تنافسية في اختبارات قياس الاستدلال.

المؤلفون الأصليون: Deepon Halder, Raj Dabre

نُشر 2026-03-17
📖 3 دقيقة قراءة☕ قراءة في استراحة قهوة

المؤلفون الأصليون: Deepon Halder, Raj Dabre

البحث الأصلي مرخَّص بموجب CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). هذا شرح مولَّده بالذكاء الاصطناعي للبحث أدناه. لم يكتبه المؤلفون ولم يصادقوا عليه. وللتحقق من الدقة التقنية، يرجى الرجوع إلى البحث الأصلي. اقرأ إخلاء المسؤولية الكامل

تخيل أنك تلعب لعبة "أكمل الجملة" مع صديق (الذكاء الاصطناعي) ذكي جداً، ولكنه مشتت الذهن قليلاً.

في كل مرة يحتاج فيها صديقك إلى اختيار الكلمة التالية، يكون لديه قائمة ضخمة من الاحتمالات. أحياناً، يكون متأكداً بنسبة 100% مما سيقوله (مثل حل 2 + 2 = ?). وفي أحيان أخرى، يكون غارقاً في أحلام اليقظة ولديه مليون فكرة رائعة لكيفية بدء قصة ما.

المشكلة في أدوات الذاء الاصطناعي الحالية هي أنها تستخدم كتيب قواعد جامد لتقرر أي الكلمات ستختار. فهي تقول: "حسناً، سننظر دائماً إلى أفضل 50 كلمة"، أو "سنختار دائماً من بين أفضل 90% من الكلمات المحتملة".

هذا يشبه استخدام شبكة ثابتة الحجم لصيد الأسماك:

  • في بركة هادئة (المنطق/الرياضيات): الأسماك تسبح في دائرة ضيقة. الشبكة الضخمة هنا ستكون هدراً؛ فهي ستصطاد الكثير من النفايات (المشتتات) وقد تسمح للسمكة المثالية الوحيدة بالإفلات عبر الثقوب لأن الشبكة فضفاضة جداً.
  • في محيط هائج (الكتابة الإبداعية): الأسماك موجودة في كل مكان. الشبكة الصغيرة ستكون عديمة الفائدة؛ فهي لن تصطاد سوى عدد قليل من الأسماك وستفقد الأسماك المذهلة التي تسبح خارج تلك الدائرة الصغيرة.

الحل: Top-b (الشبكة الذكية)

تقدم هذه الورقة طريقة جديدة تسمى Top-b. بدلاً من الشبكة ثابتة الحجم، يستخدم Top-b شبكة ذكية وقابلة للتمدد يتغير حجمها بناءً على مدى ارتباك الذكاء الاصطناعي في تلك اللحظة تحديداً.

إليك كيف يعمل الأمر، باستخدام تشبيه بسيط:

1. مقياس الارتباك (الاعتلاج - Entropy)

يتحقق الذكاء الاصطناعي باستمرار من "مقياس الارتباك" الخاص به (يسمى الاعتلاج أو Entropy).

  • ارتباك منخفض: الذكوا الاصطناعي يعرف تماماً ما سيقوله (مثلاً: "عاصمة فرنسا هي..."). المقياس منخفض.
  • ارتباك مرتفع: الذكاء الاصطناعي غير متأكد ولديه خيارات عديدة (مثلاً: "كان يا ما كان..."). المقيتر مرتفع.

2. عرض النطاق الترددي القابل للتمدد

يربط Top-b حجم "شبكته" مباشرة بهذا المقياس.

  • عندما يكون الذكاء الاصطناعي واثقاً (اعتلاج منخفض): تنكمش الشبكة. تصبح ضيقة جداً، وتركز فقط على أفضل الكلمات وأكثرها وضوحاً. إنها تتجاهل الكلمات الغريبة ذات الاحتمالية المنخفضة التي قد تسبب هلوسة للذكاء الاصطناعي أو خطأً في الرياضيات.
    • تشبيه: فكر في جراح يجري عملية دقيقة. هو لا يريد شبكة واسعة من الأدوات؛ بل يريد شبكة دقيقة وصغيرة جداً لضمان الدقة.
  • عندما يكون الذكاء الاصطناعي مبدعاً (اعتلاج مرتفع): تتمدد الشبكة. تتوسع لتشمل مجموعة متنوعة من الكلمات المثيرة للاهتمام، مما يسمح بالإبداع والمفاجأة.
    • تشبيه: فكر في عازف جاز يرتجل. هو بحاجة إلى شبكة واسعة من النغمات لاستكشاف ألحان جديدة.

لماذا هذا أفضل؟

اختبرت الورقة هذا على نوعين من المهام:

  1. الرياضيات والمنطق الصعب (GPQA/GSM8K): هنا، يحتاج الذكاء الاصطناعي إلى أن يكون مثل الروبوت. الطرق القديمة (مثل Top-p) قد تسمح أحياناً بدخول كلمات "مشتتة"، مما يجعل الذكاء الاصطناعي يتخذ مساراً خاطئاً في تفكيره. يعمل Top-b هنا كـ محرر صارم، حيث يستبعد الضجيج ويجبر الذكاء الاصطناعي على الالتزام بالمسار المنطقي. والنتيجة؟ أخطاء أقل وإجابات أكثر اتساقاً.
  2. الكتابة الإبداعية: هنا، يحتاج الذكاء الاصطناعي إلى أن يكون فناناً. يقوم Top-b تلقائياً بتخفيف القواعد عندما يشعر الذكاء الاصطناعي بـ "الإبداع"، حتى لا يقطع الأفكار الجيدة عن طريق الخطأ لمجرد أن القواعد كانت صارمة للغاية.

الخلاصة

عملية فك التشفير في الذكاء الاصطناعي الحالي تشبه قيادة سيارة باستخدام مثبت سرعة مضبوط على سرعة ثابتة، بغض النظر عما إذا كنت على طريق سريع مستقيم أو طريق جبلي متعرج. ستصطدم في المنعطفات أو تسير ببطء شديد على الطريق السريع.

Top-b يشبه مثبت السرعة التكيفي. فهو يبطئ ويشد قبضته تلقائياً عندما يصبح الطريق صعباً (المنطق/الرياضيات) ويسرع ويرخي قبضته عندما يكون الطريق مفتوحاً (الإبداع).

النتيجة هي ذكاء اصطناعي يرتكب أخطاءً سخيفة أقل عند حل المشكلات، ولكنه يظل ممتعاً ومبدعاً عند سرد القصص، وكل ذلك دون الحاجة منك إلى تعديل أي إعدادات.

غارق في أبحاث مجالك؟

تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.

جرّب Digest →