💬 NLP

Uncertainty Quantification for Large Language Diffusion Models

تقدم هذه الورقة البحثية أول دراسة منهجية لتقدير عدم اليقين لنماذج الانتشار اللغوية الكبيرة، حيث تقترح إشارات خفيفة الوزن وعديمة التدريب (zero-shot) مستمدة من عملية إزالة الضجيج، والتي تحقق كشفاً موثوقاً للهلوسة مع عبء حوسبي أقل بمقدار يصل إلى 100 ضعف مقارنة بالطرق القائمة على أخذ العينات.

Artem Vazhentsev, Vladislav Smirnov, David Li, Maxim Panov, Timothy Baldwin, Artem Shelmanov2026-05-15
💬 NLP

EndPrompt: Efficient Long-Context Extension via Terminal Anchoring

تُعد EndPrompt طريقة فعالة لتوسيع نافذة السياق للنماذج اللغوية الكبيرة إلى 64 ألف رمز باستخدام تسلسلات تدريب قصيرة فقط عبر إلحاق مطالبة نهائية تتضمن مؤشرات موضعية بالطول المستهدف، مما يحقق أداءً فائقاً في اختبارات معيارية مثل RULER وLongBench مع تجنب التكاليف الحسابية العالية للضبط الدقيق كامل الطول.

Han Tian, Luxuan Chen, Xinran Chen, Rui Kong, Fang Wang, Jiamin Chen, Jinman Zhao, Yuchen Li, Jiashu Zhao, Shuaiqiang Wa (…)2026-05-15
💬 NLP

SciPaths: Forecasting Pathways to Scientific Discovery

تقدم هذه الورقة SciPaths، وهو معيار ومهمة جديدة للتنبؤ بمسارات الاكتشاف العلمي تتطلب من النماذج تحديد وتأصيل المساهمات المُمكّنة والأعمال السابقة الضرورية لمساهمة علمية مستهدفة، مما يكشف أن النماذج اللغوية الحالية تعاني بشكل كبير من ضعف في قدرة الاستدلال المعقدة هذه.

Eric Chamoun, Yizhou Chi, Yulong Chen, Rui Cao, Zifeng Ding, Michalis Korakakis, Andreas Vlachos2026-05-15
💬 NLP

Do We Really Need External Tools to Mitigate Hallucinations? SIRA: Shared-Prefix Internal Reconstruction of Attribution

تُعد SIRA إطار عمل لفك التشفير التبايني الداخلي لا يتطلب تدريباً، حيث تعمل على الحد من الهلوسة في النماذج اللغوية البصرية الكبيرة عبر توليد مرجع مضاد يهيمن عليه الأولوية اللغوية ضمن نفس المحول من خلال الانتباه المقنع في الطبقات المتأخرة، مما يقلل من الاعتماد على الأدوات الخارجية وعمليات التمرير الأمامي الإضافية مع الحفاظ على التغطية الوصفية.

Tian Qin, Junzhe Chen, Yuqing Shi, Tianshu Zhang, Qiang Ju, Lijie Wen2026-05-15
💬 NLP

Falkor-IRAC: Graph-Constrained Generation for Verified Legal Reasoning in Indian Judicial AI

تقدم هذه الورقة Falkor-IRAC، وهو إطار عمل للتوليد المقيد بالرسوم البيانية للذكاء الاصطناعي القانوني الهندي يضمن الاستدلال المتحقق منه من خلال ربط مخرجات النماذج اللغوية الكبيرة برسوم بيانية معرفية مهيكلة بنظام IRAC واستخدام وكيل تحقق للتحقق من الاستشهادات وكشف التعارضات العقائدية، مما يعالج قيود الهلوسة والدقة في أنظمة الاسترجاد التقليدية القائمة على المتجهات.

Joy Bose2026-05-15
💬 NLP

Agentifying Patient Dynamics within LLMs through Interacting with Clinical World Model

تقدم هذه الورقة SepsisAgent، وهو نموذج لغوي كبير معزز بنموذج عالمي تم تدريبه عبر منهج تعليمي ثلاثي المراحل لمحاكاة استجابات المرضى وتحسين قرارات العلاج بشكل تكراري، مما أظهر تفوقاً في السلامة والأداء في إدارة تعفن الدم مقارنة بالنماذج المرجعية التقليدية للتعلم التعزيزي والنماذج اللغوية الكبيرة.

Minghao Wu, Yuting Yan, Zhenyang Cai, Ke Ji, Chuangsen Fang, Ziying Sheng, Xidong Wang, Rongsheng Wang, Hejia Zhang, Shu (…)2026-05-15
💬 NLP

Video2GUI: Synthesizing Large-Scale Interaction Trajectories for Generalized GUI Agent Pretraining

تقدم الورقة البحثية Video2GUI، وهو إطار عمل مؤتمت يقوم بتخليق مجموعة بيانات ضخمة تضم 12 مليون مسار تفاعل مع واجهات المستخدم الرسومية (GUI) من فيديوهات إنترنت غير مصنفة للتغلب على ندرة البيانات وتعزيز أداء تعميم وكلاء واجهات المستخدم الرسومية متعددي الوسائط بشكل كبير.

Weimin Xiong, Shuhao Gu, Bowen Ye, Zihao Yue, Lei Li, Feifan Song, Sujian Li, Hao Tian2026-05-15
⚡ electrical engineering

Streaming Speech-to-Text Translation with a SpeechLLM

تقترح هذه الورقة نظاماً للترجمة الفورية من الكلام إلى النص يعتمد على نموذج لغوي صوتي (SpeechLLM) يقرر ديناميكياً متى يرسل رموز المخرجات بناءً على المدخلات الصوتية، محققاً جودة ترجمة قريبة من المستوى المرجعي مع تقليل زمن الاستجابة بشكل كبير بمقدار 1-2 ثانية.

Titouan Parcollet, Shucong Zhang, Xianrui Zheng, Rogier C. van Dalen2026-05-15
💬 NLP

Do Composed Image Retrieval Benchmarks Require Multimodal Composition?

تكشف هذه الورقة أن معايير استرجاع الصور المركبة الحالية تبالغ في تقدير قدرات التركيب متعدد الوسائط لأن جزءاً كبيراً من الاستعلامات يمكن حله عبر طرق مختصرة أحادية الوسائط أو أنها صيغت بشكل سيئ، مما يستلزم وجود مجموعة فرعية تم التحقق منها لضمان دمج النماذج فعلياً بين المدخلات الصورية والنصية.

Matteo Attimonelli, Alessandro De Bellis, Aryo Pradipta Gema, Rohit Saxena, Monica Sekoyan, Wai-Chung Kwan, Claudio Pomo (…)2026-05-15
💬 NLP

Graphs of Research: Citation Evolution Graphs as Supervision for Research Idea Generation

تقترح الورقة البحثية "رسوم الأبحاث البيانية" (GoR)، وهي طريقة للضبط الدقيق الخاضع للإشراف تستفيد من الرسوم البيانية لتطور الاستشهادات المهيكلة المستمدة من أحياء المراجع لتحسين قدرة النماذج اللغوية الكبيرة بشكل كبير على توليد أفكار بحثية مبتكرة، محققةً أداءً هو الأفضل في فئته مقارنة بالنماذج المرجعية الحالية.

Songyang Gao, Yinghui Xia, Siyi Liu, Hui Xiong2026-05-15