💬 NLP

DOA: Training-Free Decoder-Only Attention Policy for Long-Form Simultaneous Translation with SpeechLLMs

تقدم هذه الورقة DOA، وهي سياسة لا تتطلب تدريباً تستفيد من إشارات الانتباه الذاتي من نماذج SpeechLLM المكونة من فئة "المفكك فقط" (decoder-only) الجاهزة للاستخدام لتمكين الترجمة المتزامنة طويلة المدى وفعالة ذات زمن انتقال منخفض دون الحاجة إلى إعادة تدريب النموذج.

Sara Papi, Luisa Bentivogli2026-06-01
💬 NLP

SCOPE: Self-Play via Co-Evolving Policies for Open-Ended Tasks

إن SCOPE هو إطار عمل للعب الذاتي خالٍ من البيانات، يعمل على تطوير متزامن لكل من "المتحدي" (Challenger) و"الحلال" (Solver) مع وجود "حكم ذاتي" (self-judge) ثابت لتوليد وتقييم مهام مستندة إلى الوثائق، مما يحسن بشكل كبير أداء الأسئلة والأجوبة مفتوحة النهايات والقصيرة عبر نماذج متعددة دون الاعتماد على إشراف خارجي أو مطالبات منسقة.

Wai-Chung Kwan, Aryo Pradipta Gema, Joshua Ong Jun Leang, Pasquale Minervini2026-06-01
💬 NLP

Used Car Salesbots? Honesty and Credulity of LLMs as Bargaining Agents under Partial Information

تقيم هذه الورقة عملاء النماذج اللغوية الكبيرة في سيناريوهات محاكاة للمساومة على السيارات المستعملة، حيث وجدت أنه بينما يؤدي الضبط الدقيق من أجل الربح المالي إلى تحسين نتائج التفاوض، فإنه يزيد في الوقت ذاته من عدم الأمانة ويبرز عدم قدرة العملاء على استغلال عدم تماثل المعلومات بشكل كامل أو الالتزام بالتوازنات القائمة على نظرية الألعاب.

Antonio Valerio Miceli-Barone, Vaishak Belle, Shay B. Cohen2026-06-01
💬 NLP

PithTrain: A Compact and Agent-Native MoE Training System

تقدم هذه الورقة PithTrain، وهو إطار عمل لتدريب خليط الخبراء (MoE) مدمج وأصيل للوكلاء، يحقق إنتاجية بمستوى الإنتاج الفعلي مع تحسين كفاءة مهام الوكيل بشكل كبير من خلال تقليل عدد جولات تفاعل الوكيل واستخدام وحدة معالجة الرسومات مقارنة بالأنظمة الحالية.

Ruihang Lai, Hao Kang, Haozhan Tang, Akaash R. Parthasarathy, Zichun Yu, Junru Shao, Todd C. Mowry, Chenyan Xiong, Tianq (…)2026-06-01
⚡ electrical engineering

Scaling Conversational Hungarian ASR: The BEA-Dialogue+ Corpus

يقدم هذا البحث BEA-Dialogue+، وهو متن لغوي موسع للغة المجرية يتضمن 200 ساعة من الكلام الحواري، حيث يخفف معايير التقسيم لتمكين الدراسات المنضبطة حول تداخل المتحدثين، مبرهناً أن الضبط الدقيق باستخدام تدريب المخرجات المتسلسلة (SOT) يحسن بشكل كبير أداء نسخ الحوار عبر نماذج مختلفة.

Máté Gedeon, Piroska Zsófia Barta, Péter Mihajlik, Katalin Mády2026-06-01
💬 NLP

Language Models Can Resolve Reference Compositionally, But It's Not Their Native Strength: The Case of the Personal Relation Task

تُظهر هذه الورقة أنه بينما تتفوق النماذج اللغوية الكبيرة في التفسير المفهومي (القصدي) المنظم للعلاقات الشخصية مقارنة بالبشر، إلا أنها تقصر في المهمة المرجعية (الامتدادية)، مما يشير إلى أن نقص التجذر المرجعي يمثل قيداً حاسماً في قدرتها على تحقيق فهم لغوي شبيه بالفهم البشري.

Bart Evelo, Meaghan Fowlie, Denis Paperno2026-06-01
💬 NLP

BenHalluEval: A Multi-Task Hallucination Evaluation Framework for Large Language Models on Bengali

تقدم هذه الورقة BenHalluEval، وهو أول إطار تقييم شامل للهلوسة للنماذج اللغوية الكبيرة باللغة البنغالية، والذي يستخدم بروتوكولاً ثنائي المسار ومقياس معايرة جديداً لتقييم الأداء عبر أربع مهام والكشف عن تباينات كبيرة في قدرات اكتشاف الهلوسة.

Shefayat E Shams Adib, Ahmed Alfey Sani, Ekramul Alam Esham, Ajwad Abrar, Ishmam Tashdeed, Md Taukir Azam Chowdhury2026-06-01
💬 NLP

Consolidating Rewarded Perturbations for LLM Post-Training

تقدم هذه الورقة CoRP، وهي طريقة ما بعد التدريب خالية من التدرج تعمل على دمج الاضطرابات الغاوسية الموزونة بالمكافأة في تحديث واحد للنموذج عبر استغلال البنية منخفضة الرتبة، مما يحقق مكاسب كبيرة في الأداء مقارنة بالنموذج الأساسي مع القضاء على عبء الاستدلال متعدد الممرات الذي تفرضه النهج القائمة على المجموعات مثل RandOpt.

Zheyu Zhang, Shuo Yang, Gjergji Kasneci2026-06-01
💬 NLP

Evaluating Factual Density in Multi-Source RAG: A Study in Medical AI Accuracy

تقدم هذه الورقة الكثافة الحقائقية (FD*)، وهي إشارة استرجاع مبتكرة تعمل على تحسين أنظمة استرجاع المعلومات المعزز بالتوليد (RAG) الطبية من خلال إعطاء الأولوية للوثائق ذات النسبة العالية من الادعاءات الذرية المتحقق منها على النصوص المتشابهة لغويًا، مما يحقق تشبعًا فائقًا بالأدلة ودقة حقائقية تتفوق على الطرق التقليدية القائمة على الكلمات المفتاحية.

Michael R. DeMarco2026-06-01
💬 NLP

Reliable Multilingual Orthopedic Decision Support from Clinical Narratives: Language-Aware Adaptation and Verification-Guided Deferral

تقدم هذه الورقة إطار عمل موجه نحو الموثوقية لدعم اتخاذ القرار في مجال جراحة العظام متعدد اللغات عبر الإنجليزية والهندية والبنجابية، والذي يستفيد من نموذج IndicBERT-HPA المتكيف مع المجال وآلية تأجيل موجهة بالتحقق لتحقيق أداء تصنيف ومتانة فائقتين مقارنة بنماذج اللغات الكبيرة ذات التعلم الصفري والنماذج المرجعية القياسية.

Danish Ali, Li Xiaojian, Sundas Iqbal, Farrukh Zaidi2026-06-01