💬 NLP

Mechanisms of Prompt-Induced Hallucination in Vision-Language Models

تتقصى هذه الورقة البحثية الهلوسة الناجمة عن المطالبات في نماذج الرؤية واللغة، كاشفةً أن هذه الأخطاء تنبع من رؤوس انتباه محددة تعطي الأولوية للمطالبات النصية على الأدلة البصرية، وتُثبت أن استئصال هذه الرؤوس يقلل بشكل كبير من الهلوسة دون الحاجة إلى تدريب إضافي.

William Rudman, Michal Golovanevsky, Dana Arad, Yonatan Belinkov, Ritambhara Singh, Carsten Eickhoff, Kyle Mahowald2026-04-20
💬 NLP

Reward Modeling for Scientific Writing Evaluation

تقترح هذه الورقة نموذج مكافأة مفتوح المصدر وفعال من حيث التكلفة، تم تدريبه عبر إطار عمل ثنائي المراحل للتغلب على قيود المقيمين العامين الحاليين من خلال تمكين تقييم قوي ودقيق لمهام الكتابة العلمية المتنوعة دون الحاجة إلى إعادة تدريب خاص بكل مهمة.

Furkan Şahinuç, Subhabrata Dutta, Iryna Gurevych2026-04-20
💬 NLP

FS-Researcher: Test-Time Scaling for Long-Horizon Research Tasks with File-System-Based Agents

يُعد FS-Researcher إطار عمل ثنائي الوكيل يعتمد على نظام الملفات، يتغلب على قيود نافذة السياق في مهام البحث طويلة الأمد عبر استخدام ذاكرة خارجية مستمرة لتمكين التوسع الفعال في وقت الاختبار، محققاً جودة تقارير هي الأفضل في فئتها عبر مختلف النماذج الأساسية.

Chiwei Zhu, Benfeng Xu, Mingxuan Du, Shaohan Wang, Xiaorui Wang, Zhendong Mao, Yongdong Zhang2026-04-20
💬 NLP

Large Language Models for Math Education in Low-Resource Languages: A Study in Sinhala and Tamil

تقيم هذه الدراسة قدرات الاستدلال الرياضي للنماذج اللغوية الكبيرة في اللغتين السنغالية والتاميلية منخفضتي الموارد باستخدام مجموعة بيانات متوازية أعدها مؤلفون أصليون، مما يكشف أنه بينما ينتقل الحساب الأساسي بشكل جيد، فإن أداء الاستدلال المعقد يتدهور بشكل كبير مقارنة باللغة الإنجليزية، مما يسلط الضوء على الحاجة إلى تقييمات خاصة بكل لغة قبل نشر المعلمين الآليين في السياقات التعليمية متعددة اللغات.

Sukumar Kishanthan, Kumar Thushalika, Buddhi Jayasekara, Asela Hevapathige2026-04-20
💬 NLP

Protecting Language Models Against Unauthorized Distillation through Trace Rewriting

تقترح هذه الورقة تقنيات إعادة كتابة المسارات الديناميكية التي تعدل استدلال النموذج المعلم لتعمد في آن واحد إلى إضعاف فائدة التقطير غير المصرح به وتضمين علامات مائية قابلة للتحقق في نماذج الطالب، كل ذلك مع الحفاظ على صحة وتماسك الاستجابات الأصلية.

Xinhang Ma, William Yeoh, Ning Zhang, Yevgeniy Vorobeychik2026-04-20
💻 computer science

Acoustic and Facial Markers of Perceived Conversational Success in Spontaneous Speech

تحلل هذه الدراسة مجموعة كبيرة من محادثات "زووم" العفوية لتثبت أن التناغم الصوتي والوجهي يرتبط بشكل موثوق بارتفاع النجاح المتصور للمحادثة، مما يحدد العلامات متعددة الوسائط الرئيسية لجودة التفاعل في البيئات الافتراضية.

Thanushi Withanage, Elizabeth Redcay, Carol Espy-Wilson2026-04-20
💬 NLP

Applied Explainability for Large Language Models: A Comparative Study

تقدم هذه الورقة دراسة مقارنة بين طرق التدرجات المتكاملة (Integrated Gradients)، وتدفق الانتباه (Attention Rollout)، و(SHAP) على نموذج (DistilBERT) مضبوط بدقة لتصنيف المشاعر، كاشفةً أن الطرق القائمة على التدرج تقدم تفسيرات أكثر استقراراً وبداهة، مع تسليط الضوء على المقايضات بين الكفاءة الحسابية، والمرونة، والموثوقية في قابلية تفسير النماذج اللغوية الكبيرة عملياً.

Venkata Abhinandan Kancharla2026-04-20✓ Author reviewed
🤖 machine learning

Hallucination as Trajectory Commitment: Causal Evidence for Asymmetric Attractor Dynamics in Transformer Generation

تقدم هذه الورقة دليلاً سببياً على أن الهلوسة في النماذج اللغوية ذات التوليد الذاتي تنشأ من ديناميكيات جاذبة غير متماثلة، حيث يتحدد الالتزام المبكر بالمسار بواسطة الأنظمة المشفرة في المطالبة، وتتميز بعدم تماثل سببي واضح حيث يتطلب إفساد المسار الصحيح اضطراباً واحداً فقط، بينما يتطلب التعافي من الهلوسة تدخلاً مستداماً متعدد الخطوات.

G. Aytug Akarlar2026-04-20
💬 NLP

PolicyBank: Evolving Policy Understanding for LLM Agents

تقدم الورقة البحثية PolicyBank، وهو آلية ذاكرة تمكن وكلاء النماذج اللغوية الكبيرة من صقل فهمهم للسياسات التنظيمية الغامضة ذاتياً من خلال التفاعل التكراري والتغذية الراجعة التصحيحية، مما يقلص بشكل كبير الفجوة بين سلوك الوكيل والمتطلبات الحقيقية حيث تفشل الأساليب الحالية.

Jihye Choi, Jinsung Yoon, Long T. Le, Somesh Jha, Tomas Pfister2026-04-20
💬 NLP

"Excuse me, may I say something..." CoLabScience, A Proactive AI Assistant for Biomedical Discovery and LLM-Expert Collaborations

تقدم هذه الورقة CoLabScience، وهو مساعد ذكاء اصطناعي استباقي يستخدم إطار عمل مبتكر للتعلم من البيانات الإيجابية وغير المصنفة للتدخل (PULI) ومجموعة بيانات حوار تدفق بيولوجي طبي جديدة (BSDD) لتمكين التدخلات في الوقت المناسب والسياقية في المناقشات البحثية الطبية الحيوية، مما يتغلب على القيود التفاعلية للنماذج اللغوية الكبيرة التقليدية.

Yang Wu, Jinhong Yu, Jingwei Xiong, Zhimin Tao, Xiaozhong Liu2026-04-20