💬 NLP

ADAG: Automatically Describing Attribution Graphs

تقدم الورقة البحثية ADAG، وهو مسار آلي متكامل (end-to-end) يستخدم ملفات تعريف العزو (attribution profiles)، والتجميع العنقودي المبتكر، ومفسرًا ومحاكيًا يعتمد على النماذج اللغوية الكبيرة (LLM) لتوليد أوصاف باللغة الطبيعية لرسوم العزو البيانية، مما ينجح في استعادة الدوائر القابلة للتفسير وتحديد مجموعات الميزات الضارة في النماذج اللغوية دون الاعتماد على الفحص البشري اليدوي.

Aryaman Arora, Zhengxuan Wu, Jacob Steinhardt, Sarah Schwettmann2026-04-10
💬 NLP

DIVERSED: Relaxed Speculative Decoding via Dynamic Ensemble Verification

تقترح الورقة البحثية إطار عمل DIVERSED، وهو إطار فك تشفير استنتاجي مريح يستخدم مُحقِّق تجميعي ديناميكي لدمج توزيعات النموذج المسودة والنموذج المستهدف، مما يتغلب على عقبة التحقق الصارمة للطرق القياسية لتحقيق كفاءة استنتاج أعلى بكثير مع الحفاظ على جودة التوليد.

Ziyi Wang, Siva Rajesh Kasa, Ankith M S, Santhosh Kumar Kasa, Jiaru Zou, Sumit Negi, Ruqi Zhang, Nan Jiang, Qifan Song2026-04-10
💬 NLP

How Independent are Large Language Models? A Statistical Framework for Auditing Behavioral Entanglement and Reweighting Verifier Ensembles

تقدم هذه الورقة إطاراً إحصائياً لتدقيق وقياس التشابك السلوكي بين النماذج اللغوية الكبيرة باستخدام مقاييس نظرية المعلومات، مما يثبت أن أنماط الفشل المشتركة تقوض أنظمة التحقق المستقلة، وتقترح استراتيجية إعادة وزن تعمل على تحسين دقة المجموعات بشكل كبير من خلال التخفيف من حدة الانحيازات المترابطة.

Chenchen Kuai, Jiwan Jiang, Zihao Zhu, Hao Wang, Keshu Wu, Zihao Li, Yunlong Zhang, Chenxi Liu, Zhengzhong Tu, Zhiwen Fa (…)2026-04-10
💬 NLP

Guardian-as-an-Advisor: Advancing Next-Generation Guardian Models for Trustworthy LLMs

تقدم هذه الورقة البحثية إطار "الحارس كـمستشار" (Guardian-as-an-Advisor - GaaA)، وهو إطار عمل للبوابات الناعمة يعزز سلامة النماذج اللغوية الكبيرة ويقلل من حالات الرفض المفرط عبر استخدام مستشار مُدرب لتوفير تسميات للمخاطر وشروحات كمدخلات سياقية لإعادة الاستدلال، مدعوماً بمجموعة بيانات GuardSet الجديدة، ومظهراً دقة عالية مع حد أدنى من العبء الحسابي.

Yue Huang, Haomin Zhuang, Jiayi Ye, Han Bao, Yanbo Wang, Hang Hua, Siyuan Wu, Pin-Yu Chen, Xiangliang Zhang2026-04-10
💬 NLP

Optimal Decay Spectra for Linear Recurrences

تقدم هذه الورقة البحثية إطار عمل "التدرج الطيفي المتكيف مع الموضع" (PoST)، وهو إطار عمل غير مرتبط بهيكلية محددة يعمل على تحسين أطياف الاضمحلال للنماذج المتكررة الخطية من خلال إعادة تمثيل طيفي وتدرج متكيف مع الموضع لتحقيق الذاكرة طويلة المدى المثلى وفق معيار "ميناماكس"، مما يؤدي إلى تحسينات ثابتة في نمذجة اللغة واسترجاع السياقات الطويلة عبر مختلف الهيكليات الرائدة حالياً.

Yang Cao2026-04-10
💬 NLP

Efficient and Effective Internal Memory Retrieval for LLM-Based Healthcare Prediction

تقدم الورقة البحثية إطار عمل "مفاتيح المعرفة" (K2K)، وهو إطار عمل مبتكر يعزز التنبؤ في مجال الرعاية الصحية من خلال استبدال عملية الاسترجاع الخارجي كثيفة الحوسبة بالوصول الفعال إلى الذاكرة الداخلية (مفتاح-قيمة) الموجهة بالتنشيط، مما يحقق أداءً هو الأفضل في فئته مع حد أدنى من زمن انتقال الاستدلال.

Mingchen Li, Jiatan Huang, Zonghai Yao, Hong yu2026-04-10
💬 NLP

IatroBench: Pre-Registered Evidence of Iatrogenic Harm from AI Safety Measures

تقدم IatroBench أدلة مسجلة مسبقاً على أن نماذج الذكاء الاصطنا stick التأسيسية تحجب بشكل منهجي الإرشادات الطبية المنقذة للحياة عن المستخدمين غير المتخصصين بينما تقدم نصائح دقيقة للأطباء، مما يكشف عن فشل سلامة حرج مرتبط بالهوية حيث تتسبب تدابير السلامة دون قصد في ضرر علاجي ناتج عن التدخل (iatrogenic harm) من خلال منع الوصول إلى المعلومات الأساسية لأولئك الذين استنفدوا الإحالات القياسية.

David Gringras2026-04-10
💬 NLP

Squeeze Evolve: Unified Multi-Model Orchestration for Verifier-Free Evolution

تقدم الورقة البحثية Squeeze Evolve، وهو إطار عمل موحد لتنسيق النماذج المتعددة يعمل على تحسين الاستدلال التطوري الخالي من التحقق عبر تخصيص قدرات النماذج ديناميكيًا لموازنة التنوع وكفاءة التكلفة، محققًا أداءً هو الأفضل في فئته مع تقليل تكاليف واجهة برمجة التطبيقات (API) بشكل كبير وزيادة معدل الإنتاجية عبر مختلف المعايكات.

Monishwaran Maheswaran, Leon Lakhani, Zhongzhu Zhou, Shijia Yang, Junxiong Wang, Coleman Hooper, Yuezhou Hu, Rishabh Tiw (…)2026-04-10
💬 NLP

The Art of (Mis)alignment: How Fine-Tuning Methods Effectively Misalign and Realign LLMs in Post-Training

تستقصي هذه الورقة البحثية الفعالية غير المتماثلة لطرق الضبط الدقيق في إحداث عدم المواءمة وإعادة المواءمة للنماذج اللغوية الكبيرة، كاشفةً عن أن تحسين تفضيل نسبة الأرجحية (ORPO) هو الأكثر فعالية في إحداث عدم المواءمة، بينما يتفوق تحسين التفضيل المباشر (DPO) في إعادة المواءمة رغم تقليله من فائدة النموذج.

Rui Zhang, Hongwei Li, Yun Shen, Xinyue Shen, Wenbo Jiang, Guowen Xu, Yang Liu, Michael Backes, Yang Zhang2026-04-10
💬 NLP

ORACLE-SWE: Quantifying the Contribution of Oracle Information Signals on SWE Agents

تقدم هذه الورقة Oracle-SWE، وهي طريقة موحدة لعزل وقياس التأثير الفردي لمختلف إشارات المعلومات السياقية على أداء وكلاء هندسة البرمجيات، بهدف توجيه أولويات البحث لأنظمة البرمجة الذاتية.

Kenan Li, Qirui Jin, Liao Zhu, Xiaosong Huang, Yijia Wu, Yikai Zhang, Xin Zhang, Zijian Jin, Yufan Huang, Elsie Nallipog (…)2026-04-10