💬 NLP

PDF Retrieval Augmented Question Answering

تقدم هذه الورقة إطار عمل متطور للجيل المعزز بالاسترجاع (RAG) مصمم لتعزيز الإجابة على الأسئلة المستندة إلى ملفات PDF من خلال دمج العناصر متعددة الوسائط بفعالية مثل الصور والرسوم البيانية والجداول جنباً إلى جنب مع النصوص لمعالجة الاستعلامات المعقدة عبر المعالجة الدقيقة والنماذج اللغوية الكبيرة الضبطت بدقة.

Thi Thu Uyen Hoang, Viet Anh Nguyen2026-04-07
💬 NLP

The Generalization Ridge: Information Flow in Natural Language Generation

تقدم هذه الورقة البحثية "InfoRidge"، وهو إطار عمل قائم على نظرية المعلومات يكشف عن "حافة تعميم" (generalization ridge) متسقة في النماذج اللغوية القائمة على تقنية "Transformer"، حيث تبلغ المعلومات التنبؤية ذروتها في الطبقات المتوسطة قبل أن تنخفض في الطبقات النهائية، مما يوضح الدور الحاسم لهذه الطبقات الوسطى في تحقيق التوازن بين التعميم والحفظ أثناء توليد اللغة الطبيعية.

Ruidi Chang, Chunyuan Deng, Hanjie Chen2026-04-07
💬 NLP

Making Prompts First-Class Citizens for Adaptive LLM Pipelines

تقدم هذه الورقة إطار عمل SPEAR، الذي يعامل المطالبات (prompts) كعناصر أساسية لتمكين الإدارة الهيكلية، والتحسين الديناميكي أثناء وقت التشغيل بناءً على التغذية الراجعة، والتحكم القائم على السياسات، وذلك للتغلب على قيود المطالبات الهشة وغير الشفافة في مسارات عمل النماذج اللغوية الكبيرة الحديثة.

Ugur Cetintemel, Shu Chen, Alexander W. Lee, Deepti Raghavan, Duo Lu, Andrew Crotty2026-04-07
💬 NLP

Measuring Competency, Not Performance: Item-Aware Evaluation Across Medical Benchmarks

تقدم هذه الورقة MedIRT، وهو إطار تقييم قائم على نظرية الاستجابة للمفردة (IRT) يتفوق على مقاييس الدقة التقليدية من خلال النمذجة المشتركة للكفاءة الطبية الكامنة وخصائص العناصر، مما يوفر تقييمات أكثر صلاحية واستقراراً ودقة للنماذج اللغوية الكبيرة عبر مختلف الاختبارات المرجعية الطبية.

Zhimeng Luo, Lixin Wu, Adam Frisch, Daqing He2026-04-07
💬 NLP

EvoEdit: Evolving Null-space Alignment for Robust and Efficient Knowledge Editing

تُعد EvoEdit استراتيجية مبتكرة لتحرير المعرفة تعمل على التخفيف من حدة التداخل الكارثي في التحديثات المتتالية عبر توظيف محاذاة الفضاء الصفري المتسلسل، مما يحافظ على المعرفة الأصلية والمعرفة المعدلة سابقاً مع تحقيق أداء فائق وتسريع ملحوظ مقارنة بالطرق الحالية الرائدة.

Sicheng Lyu, Yu Gu, Xinyu Wang, Jerry Huang, Sitao Luan, Yufei Cui, Xiao-Wen Chang, Peng Lu2026-04-07
💬 NLP

LLMs Judge Themselves: A Game-Theoretic Framework for Human-Aligned Evaluation

تقترح هذه الورقة إطاراً جديداً قائماً على نظرية الألعاب لتقييم النماذج اللغوية الكبيرة من خلال التقييم المتبادل الآلي بين الأقران وتجميع التصويت، مع تحليل تجريبي للتوافق والتباين بين هذه التصنيفات التي تولدها النماذج وبين الحكم البشري.

Gao Yang, Yuhang Liu, Siyu Miao, Xinyue Liang, Zhengyang Liu, Heyan Huang2026-04-07
💬 NLP

ProMediate: A Socio-cognitive framework for evaluating proactive agents in multi-party negotiation

تقدم هذه الورقة ProMediate، وهو أول إطار عمل اجتماعي معرفي ومنصة اختبار محاكاة للتقييم المنهجي لوكلاء الوساطة الاستباقيين القائمين على الذكاء الاصطناعي في المفاوضات المعقدة متعددة الأطراف، مما يثبت أن الوكلاء الأذكياء اجتماعياً يتفوقون بشكل كبير على النماذج المرجعية العامة في كل من فعالية بناء التوافق وسرعة التدخل.

Ziyi Liu, Bahar Sarrafzadeh, Pei Zhou, Longqi Yang, Jieyu Zhao, Ashish Sharma2026-04-07
💬 NLP

When AI Agents Collude Online: Financial Fraud Risks by Collaborative LLM Agents on Social Platforms

تقدم هذه الورقة MultiAgentFraudBench، وهو معيار واسع النطاق لمحاكاة الاحتيال المالي عبر 28 سيناريو عبر الإنترنت، لإظهار كيف يمكن لوكلاء النماذج اللغوية الكبيرة المتعاونين تضخيم مخاطر الاحتيال واقتراح استراتيجيات للتخفيف منها مع تسليط الضوء على قدرتهم على التكيف مع التدخلات.

Qibing Ren, Zhijie Zheng, Jiaxuan Guo, Junchi Yan, Lizhuang Ma, Jing Shao2026-04-07
💬 NLP

A Simple Method to Enhance Pre-trained Language Models with Speech Tokens for Classification

تقترح هذه الورقة طريقة بسيطة وفعالة من حيث التكلفة لتعزيز النماذج اللغوية سابقة التدريب لمهام التصنيف، وذلك عبر تطبيق اختيار الميزات القائم على "لاسو" (lasso) لتقليص تسلسلات رموز الكلام الطويلة إلى تمثيل "حقيبة كلمات" (Bag-of-Words) متعدد الوسائط وموجز، والذي يتم دمجه بعد ذلك عبر التعلم الخاضع للإشراف الذاتي لتحسين الأداء في مهام كشف المغالطات والحوسبة الوجدانية.

Nicolas Calbucura, Jose Guillen, Valentin Barriere2026-04-07
💬 NLP

BLASST: Dynamic BLocked Attention Sparsity via Softmax Thresholding

تُعد BLASST آلية انتباه متفرقة ديناميكية لا تتطلب تدريباً، تعمل على تسريع استنتاج النماذج اللغوية الكبيرة عبر بنيات مختلفة باستخدام عتبة قياسية ثابتة لتخطي كتل الانتباه الضئيلة، مما يحقق تسريعاً يصل إلى 1.52 ضعفاً مع فقدان ضئيل في الدقة.

Jiayi Yuan, Cameron Shinn, Kai Xu, Jingze Cui, George Klimiashvili, Guangxuan Xiao, Perkz Zheng, Bo Li, Yuxin Zhou, Zhou (…)2026-04-07