💬 NLP

Residual Skill Optimization for Text-to-SQL Ensembles

تقدم الورقة البحثية DivSkill-SQL، وهو إطار عمل لتحسين المهارات المتبقية يقوم ببناء مجموعات متكاملة من نماذج (Text-to-SQL) عبر تدريب مهارات جديدة بشكل تكراري على الإخفاقات السابقة دون ضبط دقيق للنموذج، مما يؤدي إلى تحسين دقة Pass@K بشكل كبير وتقليل الهلوسة عبر مختلف لهجات SQL والمهام.

Jiongli Zhu, Haoquan Guan, Parjanya Prajakta Prashant, Nikki Lijing Kuang, Seyedeh Baharan Khatami, Canwen Xu, Xiaodong (…)2026-05-22
💬 NLP

Why Semantic Entropy Fails: Geometry-Aware and Calibrated Uncertainty for Policy Optimization

تحدد هذه الورقة فجوات متباينة القياس ومعايرة حرجة في مقدرات عدم اليقين القائمة على الإنتروبيا للنماذج اللغوية الكبيرة في مرحلة ما بعد التدريب، وتقترح "تحسين السياسة المعاير المعتمد على الهندسة" (GCPO)، وهو إطار عمل مبتكر يدمج مقاييس مدركة للهندسة ومعايرة قائمة على المكافأة لتتبع تباين التدرج بشكل أكثر دقة وتحسين استقرار التحسين.

Zheyuan Zhang, Kaiwen Shi, Han Bao, Zehong Wang, Tianyi Ma, Yanfang Ye2026-05-22
💬 NLP

When Cases Get Rare: A Retrieval Benchmark for Off-Guideline Clinical Question Answering

تقدم هذه الورقة البحثية OGCaReBench، وهو معيار تقييم يركز على الاسترجاع صُمم لتقييم النماذج اللغوية الكبيرة في الأسئلة السريرية النادرة والخارجة عن الإرشادات، مما يثبت أنه في حين أن المعرفة المحفوظة غير كافية، فإن تعزيز النماذج بالأدلة الطبية المسترجعة يحسن بشكل كبير من قدرتها على تقديم إجابات موثوقة ومستندة إلى الأدلة.

Doeun Lee, Muge Zhang, Yi Yu, Ashish Manne, Stephen Koesters, Frank Wen, Brady Buchanan, Lynda Villagomez, Oluwatoba Mon (…)2026-05-22
💬 NLP

Does Slightly Mean Somewhat? Measuring Vague Intensity Words in LLM Numeric Actions

تكشف هذه الدراسة أنه في مهمة محكومة لتخصيص الموارد، تقوم النماذج اللغوية بضغط التمايزات الرتبية لكلمات الكثافة الغامضة إلى مجموعة محدودة من المخرجات الرقمية، حيث يصبح سلوكها معتمداً بشكل كبير على حالة النظام الحالية ويظهر أنماطاً غير مستمرة بالقرب من الحدود التشغيلية.

Daniel Tabach (Georgia Institute of Technology)2026-05-22
⚡ electrical engineering

Energy-Gated Attention: Spectral Salience as an Inductive Bias for Transformer Attention

تقدم هذه الورقة انتباه البوابة الطاقية (EGA)، وهو تعديل فعال من حيث المعلمات لنماذج المحولات يقوم ببوابة تجميع القيم بناءً على الطاقة الطيفية المتعلمة لتضمينات الرموز لإعطاء الأولوية للرموز ذات الكثافة المعلوماتية، محققاً تحسينات متسقة في خسارة التحقق على معايير النمذجة اللغوية، مع الكشف عن أن عتبات الطاقة المثلى تتوافق مع الجزء المستقر من كلمات المحتوى في النصوص الإنجليزية.

Athanasios Zeris2026-05-22
💬 NLP

Comparing LLM and Fine-Tuned Model Performance on NVDRS Circumstance Extraction with Varying Prompt Complexity

تقترح هذه الورقة بنية هجينة تختار ديناميكياً بين النماذج اللغوية الكبيرة ونموذج RoBERTa المضبوط بدقة لاستخراج ظروف الانتحار وفقاً لنظام بيانات تقارير وفيات الطرق الوطنية (NVDRS) بناءً على "درجة التعقيد"، مما يثبت أن النماذج اللغوية الكبيرة تتفوق بشكل كبير على النماذج المضبوطة بدقة في الحالات النادرة والمعقدة استنتاجياً، بينما تظل الأخيرة فعالة في الحالات الشائعة.

Geoffrey Martin, Xuan Zhong Feng, Yifan Peng2026-05-22
💬 NLP

Geometry-Adaptive Explainer for Faithful Dictionary-Based Interpretability under Distribution Shift

تقدم هذه الورقة "المفسر المتكيف هندسياً" (GAE)، وهو طريقة خالية من التدرج تعمل على إعادة محاذاة أدوات التفسير القائمة على القواميس مع الفضاءات الفرعية للتنشيط خارج نطاق التوزيع، وذلك لتحسين الأمانة السببية بشكل كبير تحت تحولات التوزيع.

Sungjun Lim, Heedong Kim, Andrew Lee, Kyungwoo Song2026-05-22
💬 NLP

SpecHop: Continuous Speculation for Accelerating Multi-Hop Retrieval Agents

تقدم الورقة البحثية SpecHop، وهو إطار عمل للتخمين المستمر يستخدم خيوط معالجة متعددة غير متزامنة للتنبؤ بمخرجات الأدوات والتحقق منها في مهام الاسترجاع متعددة الخطوات، مما يقلل زمن الاستجابة الفعلي بنسبة تصل إلى 40% دون المساس بالدقة.

Mehrdad Saberi, Keivan Rezaei, Soheil Feizi2026-05-22
💬 NLP

Blind Spots in the Guard: How Domain-Camouflaged Injection Attacks Evade Detection in Multi-Agent LLM Systems

تكشف هذه الورقة أن كواشف الحقن في أنظمة النماذج اللغوية الكبيرة متعددة الوكلاء تعاني من "فجوة كشف التمويه"، حيث تفشل في تحديد الهجمات التي تحاكي المفردات الخاصة بمجال معين وهياكل السلطة، مما يتسبب في انخفاض معدلات الكشف بشكل حاد ويكشف عن ثغرة هيكلية حرجة في آليات السلامة.

Aaditya Pai2026-05-22✓ Author reviewed
💬 NLP

From TF-IDF to Transformers: A Comparative and Ensemble Approach to Sentiment Classification

تقيم هذه الورقة نماذج مختلفة من تعلم الآلة ومعالجة اللغات الطبيعية لتصنيف المشاعر على مجموعة بيانات IMDb، حيث وجدت أن نموذج RoBERTa يحقق أعلى دقة بنسبة 93.02% بينما يعزز نظام التصويت الناعم (soft voting) لجميع النماذج الأداء العام بشكل أكبر.

Dip Biswas Shanto, Mitali Yadav, Prajwal Panth, Suresh Chandra Satapathy2026-05-22