💬 NLP

False Fixed Points: Kantian Feedback, Stable Miscalibration, and Representational Compression in LLMs

تتحدى هذه الورقة الرأي القائل بأن الأخطاء ذات الثقة العالية في النماذج اللغوية الكبيرة هي مجرد إخفاقات هشة، وذلك من خلال إثبات أنها يمكن أن تكون "نقاط ثابتة خاطئة" مستقرة ومتماسكة داخلياً حيث تتباعد المتانة عن تتبع الحقيقة، وهي ظاهرة مدفوعة بآليات مثل عطالة نسبة الإشارة إلى الضجيج العالية والضغط التمثيلي.

Akira Okutomi2026-05-26
💬 NLP

What Questions Should Robots Be Able to Answer? A Dataset of User Questions for Explainable Robotics

تقدم هذه الورقة مجموعة بيانات مكونة من 1,893 سؤالاً من المستخدمين موجهة للروبوتات المنزلية، جُمعت من 100 مشارك عبر 12 فئة، لتوجيه تطوير الروبوتات القابلة للتفسير من خلال الكشف عن أن المستخدمين يسألون بشكل متكرر عن تنفيذ المهام، لكنهم يعطون الأولوية لفهم كيفية تعامل الروبوتات مع السيناريوهات الصعبة، مع تباين أنماط الأسئلة بشكل كبير بين المستخدمين المبتدئين والمتمرسين.

Lennart Wachowiak, Andrew Coles, Gerard Canal, Oya Celiktutan2026-05-26
💬 NLP

Probability Distributions Computed by Autoregressive Transformers

تُوصّف هذه الورقة التوزيعات الاحتمالية التي يمكن التعبير عنها بواسطة النماذج اللغوية للمحولات ذاتية الانحدار، مبرهنةً على أن طبيعتها ذاتية الانحدار والاحتمالية يمكن أن تزيد من القدرة التعبيرية وتكسر أوجه التكافؤ الموجودة في المعرّفات اللغوية غير الاحتمالية.

Andy Yang, Anej Svete, Jiaoda Li, Anthony Widjaja Lin, Jonathan Rawski, Ryan Cotterell, David Chiang2026-05-26
💬 NLP

AI-generated podcasts: Synthetic Intimacy and Cultural Mistranslation in NotebookLM's Audio Overviews

تحلل هذه الورقة البودكاستات الناتجة عن أداة NotebookLM من جوجل كشكل إعلامي جديد يعتمد على قالب ثابت لتقنين المحتويات المتنوعة ضمن إطار ثقافي أمريكي من منطقة الغرب الأوسط، يتميز بكونه أبيض ومتعلم، مما يؤدي إلى تحويل نوع البودكاست من أداة للتفاعل مع مجتمعات محددة إلى وسيط مجرد ومتجانس.

Jill Walker Rettberg2026-05-26
💬 NLP

Asking LLMs to Verify First is Almost Free Lunch

تقدم الورقة البحثية استراتيجية "التحقق أولاً" (Verification-First)، وهي استراتيجية صياغة أوامر منخفضة التكلفة تعزز استدلال النماذج اللغوية الكبيرة من خلال جعل النماذج تتحقق من الإجابات المرشحة قبل توليد الحلول، مما يقلل من مساحة البحث المنطقي ويتفوق بشكل كبير على أسلوب "سلسلة الأفكار" القياسي وطرق توسيع النطاق الحالية في وقت الاختبار عبر مختلف المعايير المرجعية.

Shiguang Wu, Quanming Yao2026-05-26
💬 NLP

Coupled Variational Reinforcement Learning for Language Model General Reasoning

تقدم هذه الورقة CoVRL، وهو إطار عمل مبتكر يربط بين الاستدلال التبايني والتعلم التعزيزي من خلال استراتيجية أخذ عينات هجينة للتغلب على عدم كفاءة الأساليب الخالية من المُحقِّق عبر ضمان تماسك قوي بين مسارات الاستدلال والإجابات النهائية، مما يؤدي إلى تحسين أداء النماذج اللغوية في الاستدلال العام بشكل كبير.

Xueru Wen, Jie Lou, Yanjiang Liu, Hongyu Lin, Ben He, Xianpei Han, Le Sun, Yaojie Lu, Debing Zhang2026-05-26
💬 NLP

Mitigating Hallucinations in Healthcare LLMs with Granular Fact-Checking and Domain-Specific Adaptation

تقترح هذه الورقة إطار عمل لنماذج اللغات الكبيرة مخصص للرعاية الصحية يجمع بين نموذج تلخيص تم ضبطه باستخدام تقنية LoRA والتدريب على مجموعة بيانات MIMIC-III، وبين وحدة مستقلة للتحقق من الحقائق ذات دقة عالية، وذلك لتقليل الهلوسة بشكل كبير وضمان موثوقية المخرجات السريرية.

Musarrat Zeba, Abdullah Al Mamun, Kishoar Jahan Tithee, Debopom Sutradhar, Mohaimenul Azam Khan Raiaan, Saddam Mukta, Re (…)2026-05-26
💬 NLP

Routing by Analogy: kNN-Augmented Expert Assignment for Mixture-of-Experts

تقدم هذه الورقة البحثية kNN-MoE، وهو إطار عمل للتوجيه المعزز بالاسترجاع يعمل على تحسين نماذج خليط الخبراء (Mixture-of-Experts) ديناميكياً من خلال الاستفادة من ذاكرة لقرارات التوجيه المثلى السابقة وآليات تراجع مدفوعة بالثقة للتعامل مع تغيرات التوزيع بشكل أكثر فعالية من الموجهات المجمدة.

Boxuan Lyu, Soichiro Murakami, Hidetaka Kamigaito, Peinan Zhang2026-05-26
💬 NLP

Future-KL Regularized GRPO: Process-Level Credit Assignment from ff-Divergence Regularization

تقدم هذه الورقة البحثية طريقة "تحسين السياسة المنظمة بـ KL المستقبلية" (FRPO)، وهي طريقة خالية من الناقد تعمل على تصحيح تنظيم KL على مستوى الرمز (token) في طريقة GRPO عبر دمج عائد "العودة إلى ما تبقى" (return-to-go) المنظم مستقبلياً وعلاقياً والمستمد من تباعد ff، مما يؤدي إلى تحسين أداء الاستدلال الرياضي مع الحفاظ على اعتلاج (entropy) أعلى وانزياح سياسة أقل.

Jiarui Yao, Ruida Wang, Hao Bai, Tong Zhang2026-05-26
💬 NLP

PathWise: Planning through World Model for Automated Heuristic Design via Self-Evolving LLMs

يُعد PathWise إطار عمل جديداً متعدد الوكلاء يعزز التصميم الآلي للاستدلالات في التحسين التوافقي من خلال صياغة العملية كمسألة اتخاذ قرار متسلسلة واعية بالحالة عبر رسم بياني للاستلزام، مما يستبدل التجربة والخطأ القائمين على الرؤية الضيقة بالتخطيط الاستراتيجي والاستدلال ذاتي التطور لتحقيق تقارب أسرع وتعميم أفضل.

Oguzhan Gungordu, Siheng Xiong, Faramarz Fekri2026-05-26