💬 NLP

TimelineReasoner: Advancing Timeline Summarization with Large Reasoning Models

تقدم الورقة البحثية TimelineReasoner، وهو إطار عمل مبتكر يسخر نماذج الاستدلال الكبيرة لتحويل تلخيص الخط الزمني من مجرد توليد سلبي إلى عملية نشطة مكونة من مرحلتين من الإدراك الشامل واستكشاف التفاصيل، مما يحسن الدقة والتغطية والتماسك بشكل كبير مقارنة بالطرق الحالية.

Liancheng Zhang, Xiaoxi Li, Zhicheng Dou2026-05-14
💬 NLP

Correct Answers from Sound Reasoning: Verifiable Process Supervision for Language Models

تقترح هذه الورقة "الإشراف على العملية القابل للتحقق" (VPS)، وهو إطار عمل لما بعد التدريب يعمل على تحسين دقة التنبؤ وجودة الاستدلال بشكل مشترك من خلال مكافآت تكيفية على مستوى الخطوات، مما يثبت أنه على عكس التعلم المعزز القائم على الدقة فقط والذي يؤدي إلى تدهور سلامة الاستدلال، فإن VPS يمكّن النماذج اللغوية من تحقيق كل من الدقة العالية والاستدلال السليم والمتسق في المجالات القابلة للتحقق مثل الشطرنج.

Kyuyoung Kim, Kevin Wang, Yunfei Xie, Peiyang Xu, Peiyao Sheng, Chen Wei, Zhangyang Wang, Jinwoo Shin, Pramod Viswanath (…)2026-05-14
💬 NLP

ToolWeave: Structured Synthesis of Complex Multi-Turn Tool-Calling Dialogues

تقدم الورقة البحثية ToolWeave، وهو إطار عمل هيكلي يعمل على توليد حوارات استدعاء الأدوات متعددة الأدوار والواقعية من خلال فرض تبعيات الأدوات وتتبع مصدر المعلمات بدقة متناهية، مما يؤدي إلى تحسين جودة التفاعل متعدد الخطوات بشكل كبير وتحقيق أداء فائق في الاختبارات المرجعية للنماذج اللغوية الكبيرة الضبطية مقارنة بمجموعات البيانات الحالية.

Dinesh Khandelwal, Gnana Prakash Punnavajhala, GPS Bhargav, Gaurav Pandey, Sachin Joshi, Hima Karanam, Dinesh Raghu2026-05-14
💬 NLP

In-Situ Behavioral Evaluation for LLM Fairness, Not Standardized-Test Scores

تجادل هذه الورقة بأن عدالة النماذج اللغوية الكبيرة يجب أن تُقيّم من خلال سلوك المحادثة متعدد الوكلاء في سياقه الطبيعي بدلاً من اختبارات المعايير القياسية، مقدمةً إطار عمل "MAC-Fairness" للكشف عن بصمات سلوكية مستقرة وخاصة بكل نموذج، والتي تحجبها عدم الموثوقية الهيكلية للاختبارات القائمة على الأوامر التقليدية.

Zeyu Tang, Sang T. Truong, Deonna Owens, Shreyas Sharma, Yibo Jacky Zhang, Brando Miranda, Sanmi Koyejo2026-05-14
💬 NLP

Training LLMs with Reinforcement Learning for Intent-Aware Personalized Question Answering

تقدم هذه الورقة البحثية إطار عمل IAP، وهو إطار تعلم تعزيزي يعزز الإجابة الشخصية على الأسئلة أحادية الدور من خلال تدريب النماذج اللغوية على استنتاج ودمج القصد الضمني للمستخدم صراحةً في عملية الاستدلال الخاصة بها، مما يؤدي إلى تفوقها على النماذج المرجعية الحالية في معيار LaMP-QA.

Maryam Amirizaniani, Benjamin Charles Germain Lee, Jevin West, Nicholas Weber2026-05-14
💬 NLP

All Circuits Lead to Rome: Rethinking Functional Anisotropy in Circuit and Sheaf Discovery for LLMs

تتحدى هذه الورقة الافتراض القائل بأن وظائف النماذج اللغوية الكبيرة تعتمد على آليات داخلية فريدة من نوعها عبر إثبات إمكانية تعايش دوائر متعددة متباينة بنيوويًا ومخلصة للوظيفة، مقدمةً منهجية مدركة للتداخل للكشف عن هذه التفسيرات غير التقليدية، ومقترحةً إطارًا نظريًا قائمًا على التراكب عالي الأبعاد لتفسير هذا التباين الوظيفي المتأصل.

Xi Chen, Mingyu Jin, Jingcheng Niu, Yutong Yin, Jinman Zhao, Bangwei Guo, Dimitris N. Metaxas, Zhaoran Wang, Yutao Yue (…)2026-05-14
💬 NLP

Simulating Students or Sycophantic Problem Solving? On Misconception Faithfulness of LLM Simulators

تكشف هذه الورقة أن محاكيات الطلاب الحالية القائمة على النماذج اللغوية الكبيرة تفشل في الحفاظ على مفاهيم خاطئة متماسكة أثناء التفاعلات، حيث تظهر بدلاً من ذلك نزعة "تملقية" لتصحيح الإجابات بشكل عشوائي بغض النظر عن صلة التغذية الراجعة، لكنها تثبت أن إخلاص هذه المفاهيم الخاطئة يمكن تحسينه بشكل كبير من خلال مسار تدريب لاحق متخصص يتضمن الضبط الدقيق الخاضع للإشراف والتعلم التعزيزي.

Heejin Do, Shashank Sonkar, Mrinmaya Sachan2026-05-14
🤖 machine learning

WriteSAE: Sparse Autoencoders for Recurrent State

تقدم هذه الورقة WriteSAE، وهو أول مشفر تلقائي متناثر (sparse autoencoder) مصمم لتفكيك وتحرير عمليات كتابة ذاكرة التخزين المؤقت للمصفوفات (matrix cache writes) في نماذج اللغة ذات فضاء الحالة (state-space) والنماذج المتكررة الهجينة، وذلك عبر تحليل ذرات فك التشفير إلى شكل تحديثها الأصلي من الرتبة 1 (rank-1 update shape)، مما يتيح تدخلات سلوكية دقيقة وتنبؤاً عالي الدقة بالأثر.

Jack Young2026-05-14
💬 NLP

REALISTA: Realistic Latent Adversarial Attacks that Elicit LLM Hallucinations

تقدم الورقة البحثية REALISTA، وهو إطار عمل هجومي تنافسي مبتكر يقوم بتوليد مطالبات واقعية محفزة للهلوسة من خلال تحسين التوليفات المستمرة لاتجاهات التعديل المتكافئة دلاليًا في الفضاء الكامن، متجاوزًا بذلك قيود الطرق المنفصلة والمستمرة الحالية لاستهداف كل من النماذج مفتوحة المصدر ونماذج الاستدلال الكبيرة بفعالية.

Buyun Liang, Jinqi Luo, Liangzu Peng, Kwan Ho Ryan Chan, Darshan Thaker, Kaleab A. Kinfu, Fengrui Tian, Hamed Hassani, R (…)2026-05-14
💬 NLP

Mechanism Plausibility in Generative Agent-Based Modeling

تقدم هذه الورقة "مقياس المعقولية الآلية"، وهو إطار عمل مكون من أربعة مستويات يميز بين الكفاية التوليدية للنموذج ومعقوليته الآلية من خلال دمج محاكاة الوكلاء القائمة على النماذج اللغوية الكبيرة مع فلسفة العلوم لتقييم مدى قدرة هذه النماذج على تفسير الأنشطة المنظمة التي تنتج الظواهر الاجتماعية بشكل أفضل.

Patrick Zhao, David Huu Pham, Nicholas Vincent2026-05-14