🤖 AI

Bucketing the Good Apples: A Method for Diagnosing and Improving Causal Abstraction

تقدم هذه الورقة طريقة تشخيصية للتجريد السببي في الشبكات العصبية تقوم بتقسيم فضاء المدخلات إلى مناطق جيدة التفسير ومنخفضة التفسير بناءً على تدخلات التبادل، مما يمكّن الباحثين من تحديد المواضع التي تفشل فيها التفسيرات ويوفر استدلالات عملية لصقل وتحسين الفرضيات السببية عالية المستوى.

Li Puyin, Jiyuan Tan, Ahmad Jabbar, Thomas Icard, Atticus Geiger2026-05-06
🤖 AI

Zero-Shot Confidence Estimation for Small LLMs: When Supervised Baselines Aren't Worth Training

تُثبت هذه الورقة أن إشارات الثقة من نوع "التعلم الصفري" (zero-shot)، ولا سيما متوسط احتمالية الرمز (token log-probability) وطريقة التقييم الذاتي الجديدة المشروطة بالاسترجاع، تتفوق على النماذج المرجعية الخاضعة للإشراف في تقدير صحة النماذج اللغوية الصغيرة من أجل توجيه الاستعلامات بتكلفة فعالة، حتى بدون أي بيانات تدريبية.

Luong N. Nguyen2026-05-06
💬 NLP

InfoLaw: Information Scaling Laws for Large Language Models with Quality-Weighted Mixture Data and Repetition

تقدم الورقة البحثية InfoLaw، وهو إطار عمل جديد للتوسع يعتمد على البيانات ويقوم بنمذجة مرحلة ما قبل التدريب كعملية تراكم للمعلومات للتنبؤ بدقة بأداء النماذج اللغوية الكبيرة عبر توليفات بيانات وأوزان جودة ومستويات تكرار متفاوتة، مما يتيح الاختيار الأمثل لوصفات البيانات حتى في حالات الإفراط في التدريب أو محدودية البيانات.

Fengze Liu, Weidong Zhou, Binbin Liu, Ping Guo, Zijun Wang, Bingni Zhang, Yifan Zhang, Yifeng Yu, Xiaohuan Zhou, Taifeng (…)2026-05-06
💬 NLP

Is It Novel and Why? Fine-Grained Patent Novelty Prediction Based on Passage Retrieval

تقدم هذه الورقة FiNE-Patents، وهي مجموعة بيانات دقيقة للغاية وسير عمل مبتكر يعتمد على النماذج اللغوية الكبيرة ينقل التنبؤ بجدة براءات الاختراع من التصنيف الثنائي العام إلى مهمة استرجاع واستدلال دقيقة، مما يظهر أداءً فائقاً في تحديد مقاطع الفن السابق المحددة ومتانة ضد الارتباطات الزائفة.

Valentin Knappich, Anna Hätty, Simon Razniewski, Annemarie Friedrich2026-05-06
🤖 AI

The Compliance Trap: How Structural Constraints Degrade Frontier AI Metacognition Under Adversarial Pressure

تقدم هذه الورقة إطار تقييم SCHEMA لتكشف أن نماذج الذكاء الاصطناعي الرائدة تعاني غالباً من تدهور معرفي وراء معرفي كارثي تحت الضغط العدائي، ليس بسبب تهديدات البقاء، بل بسبب "فخ الامتثال" حيث يتجاوز اتباع التعليمات الحدود المعرفية، وهو فشل تظهره نماذج الاستدلال المتقدمة بشدة بينما يمكن للتدريب الخاص بالمحاذاة مثل الذكاء الاصطناعي الدستوري أن يمنعه بفعالية.

Rahul Kumar2026-05-06
🤖 AI

Measuring AI Reasoning: A Guide for Researchers

تجادل هذه الورقة بأن تقييم استدلال الذكاء الاصطناعي يجب أن ينتقل من الاعتماد حصرياً على دقة الإجابة النهائية إلى نهج قائم على العملية يقيم مدى أمانة وصحة مسارات الاستدلال الوسيطة، كون البحث التكيفي متعدد الخطوات يختلف بنيوياً عن عمليات المرور الأمامية الأحادية ويعد ضرورياً لتشخيص سلوك النموذج.

Munachiso Samuel Nwadike, Zangir Iklassov, Kareem Ali, Rifo Genadi, Kentaro Inui2026-05-06
💬 NLP

Leveraging Argument Structure to Predict Content Hatefulness

تُثبت هذه الورقة أن الاستفادة من تعليقات بنية الحجج (المقدمات والنتائج) من مجموعة بيانات WSF-ARG+ يمكن أن تتنبأ بفعالية بمدى كراهية رسائل منتديات تفوق العرق الأبيض الإجمالية، محققةً ما يصل إلى 96% في مقياس F1، مما يقدم نهجاً واعداً لمكافحة اضطراب المعلومات.

Nicolás Benjamín Ocampo, Davide Ceolin2026-05-06
💬 NLP

Accurate Legal Reasoning at Scale: Neuro-Symbolic Offloading and Structural Auditability for Robust Legal Adjudication

تقدم هذه الورقة "الذكاء المستهلك" (Amortized Intelligence)، وهو إطار عمل عصبي-رمزي يترجم النصوص القانونية إلى تمثيل رسومي حتمي (DACL) لتحقيق اتساق استدلالي يقارب المثالية، وخفض في التكلفة يتجاوز 90%، وقابلية كاملة للتدقيق الهيكلي، مما يتغلب بفعالية على قيود الموثوقية والكفاءة لنماذج الاستدلال اللغوية الكبيرة الاحتمالية في الفصل القانوني.

Stanisław Sójka, Witold Kowalczyk2026-05-06
💬 NLP

A multilingual hallucination benchmark: MultiWikiQHalluA

تقدم هذه الورقة البحثية MultiWikiQHalluA، وهو معيار قياسي متعدد اللغات للهلوسة يغطي 306 لغات، وتستخدمه لتوضيح أن معدلات الهلوسة أعلى بكثير في اللغات ذات الموارد المنخفضة والنماذج الأصغر، مع أداء أفضل للنماذج الأكبر عبر اللغات الأوروبية التي تم تقييمها.

Freja Thoresen, Dan Saattrup Smart2026-05-06
💬 NLP

Revisiting Semantic Role Labeling: Efficient Structured Inference with Dependency-Informed Analysis

تقدم هذه الورقة إطار عمل قائمًا على المشفر (encoder) ومُحدثًا ومعتمدًا على التبعية لوسم الأدوار الدلالية، يحقق سرعة استدلال تبلغ 10 أضعاف مع أداء مماثل أو أفضل مقارنة بالأنظمة القديمة، بينما يوفر قيودًا هيكلية صريحة ويُمكّن الإسقاط متعدد اللغات.

Sangpil Youm, Leah Jones, Bonnie J. Dorr2026-05-06