🤖 AI

Selective LoRA for Visual Tokens and Attention Heads

تقدم الورقة البحثية Image-LoRA، وهي طريقة لضبط المعلمات بكفاءة عالية تهدف إلى تكييف الرموز المرئية فقط ومجموعة فرعية مدمجة من مسارات القيم لرؤوس الانتباه، وذلك لتقليل التكاليف الحسابية مع الحفاظ على أداء النموذج الأساسي المجمد في النصوص النقية.

Tiange Luo, Lajanugen Logeswaran, Jaekyeom Kim, Justin Johnson, Honglak Lee2026-05-12
🤖 AI

LENS: LLM-Enabled Narrative Synthesis for Mental Health by Aligning Multimodal Sensing with Language Models

تقدم الورقة البحثية إطار عمل LENS، الذي يعمل على مواءمة بيانات المستشعرات متعددة الوسائط مع النماذج اللغوية الكبيرة عبر مشفر على مستوى الرقعة (patch-level encoder) ومجموعة بيانات ضخمة من النصوص والمستشعرات لتوليد سرديات صحة نفسية ذات دلالة سريرية، مما يمكّن النماذج اللغوية الكبيرة من التفكير بناءً على الإشارات السلوكية الخام لتحسين اتخاذ القرار السريري.

Wenxuan Xu, Arvind Pillai, Subigya Nepal, Amanda C Collins, Daniel M Mackin, Michael V Heinz, Tess Z Griffin, Nicholas C (…)2026-05-12
🤖 machine learning

DUALFloodGNN: Physics-informed Graph Neural Network for Operational Flood Modeling

تقدم الورقة البحثية DUALFloodGNN، وهي شبكة عصبية رسومية مبتكرة مستوحاة من الفيزياء تدمج القيود الفيزيائية على المستويين العالمي والمحلي للتنبؤ بسرعة ودقة بمتغيرات هيدرولوجية متعددة للنمذجة التشغيلية للفيضانات، متفوقة بذلك على مناهج الشبكات العصبية الرسومية الحالية مع الحفاظ على كفاءة حوسبية عالية.

Carlo Malapad Acosta, Herath Mudiyanselage Viraj Vidura Herath, Jia Yu Lim, Abhishek Saha, Sanka Rasnayaka, Lucy Marshal (…)2026-05-12
🤖 AI

Recursive Language Models

تقدم هذه الورقة النماذج اللغوية التكرارية (RLMs)، وهي نموذج لتوسيع نطاق الاستدلال يُمكّن النماذج اللغوية الكبيرة من تفكيك ومعالجة المطالبات الطويلة بشكل تعسفي برمجياً وبشكل تكراري، مما يحقق أداءً يتفوق بشكل كبير على الأساليب الحالية للسياقات الطويلة والنماذج الرائدة مع الحفاظ على تكاليف مماثلة.

Alex L. Zhang, Tim Kraska, Omar Khattab2026-05-12
🤖 AI

Spectral Characterization and Mitigation of Sequential Knowledge Editing Collapse

تقدم هذه الورقة البحثية إطار عمل REVIVE، وهو إطار عمل جاهز للاستخدام (plug-and-play) يعمل على التخفيف من حدة الانهيار الكارثي في تحرير المعرفة المتسلسل عبر استخدام التحليل الطيفي لتحديد والحفاظ على الفضاء الجزئي المنفرد المهيمن للأوزان مسبقة التدريب، مما يحافظ على كل من فعالية التحرير وأداء النموذج العام حتى بعد آلاف عمليات التحرير.

Chi Zhang, Mengqi Zhang, Xiaotian Ye, Runxi Cheng, Zisheng Zhou, Ying Zhou, Pengjie Ren, Zhumin Chen2026-05-12
🤖 machine learning

Knowledge is Not Enough: Injecting RL Skills for Continual Adaptation

تقترح الورقة البحثية "نقل المهارة البارامتري" (PaST)، وهو إطار عمل يعالج أوجه القصور في الضبط الدقيق الخاضع للإشراف في تكييف النماذج اللغوية الكبيرة من خلال الحقن الخطي لمتجهات مهارات غير مرتبطة بنطاق محدد مستمدة من التعلم التعزيزي، مما يتيح تكيفاً مستمراً فعالاً ومؤثراً لدمج المعرفة والاستخدام الوكيل للأدوات.

Pingzhi Tang, Yiding Wang, Muhan Zhang2026-05-12
🤖 AI

A Scalable Entity-Based Framework for Auditing Bias in LLMs

تقدم هذه الورقة إطار عمل قائمًا على الكيانات وقابلًا للتوسع لتدقيق التحيز في النماذج اللغوية الكبيرة، يستفيد من البيانات الاصطناعية لإجراء أكبر دراسة حتى الآن (1.9 مليار نقطة بيانات)، كاشفةً عن تفاوتات منهجية مثل المحاباة السياسية والجغرافية التي تستمر رغم الضبط التوجيهي وتتفاقم مع زيادة حجم النموذج.

Akram Elbouanani, Aboubacar Tuo, Adrian Popescu2026-05-12
🤖 AI

Expert Evaluation and the Limits of Human Feedback in Mental Health AI Safety Testing

تُثبت هذه الورقة أنه في اختبار سلامة الذكاء الاصطناعي في مجال الصحة النفسية، يُظهر تعليق الخبراء البشري اختلافاً منهجياً ومبنياً على أسس بدلاً من كونه خطأً عشوائياً، مما يتحدى افتراض وجود حقيقة مرجعية صالحة ويشير إلى أن تقييم الذكاء الاصطناعي في الحالات الحرجة للسلامة يجب أن ينتقل من التجميع القائم على الإجماع إلى الأساليب التي تحافظ على تنوع وجهات النظر المهنية.

Kiana Jafari, Paul Ulrich Nikolaus Rust, Duncan Eddy, Robbie Fraser, Nina Vasan, Darja Djordjevic, Akanksha Dadlani, Max (…)2026-05-12
🤖 machine learning

The Geometric Reasoner: Manifold-Informed Latent Foresight Search for Long-Context Reasoning

يُعد المستنتج الهندسي (TGR) إطار عمل لا يتطلب تدريباً، يعمل على تعزيز الاستنتاج طويل السياق تحت قيود صارمة للذاكرة من خلال إجراء بحث استشرافي كامن مستنير بالمتشعبات مع إعادة ضبط ذاكرة التخزين المؤقت لـ (KV) على مستوى الأجزاء، محققاً تحسينات كبيرة في تغطية المسارات في اختبارات الرياضيات والبرمجة مع تكلفة حسابية ضئيلة.

Ren Zhuang, Ben Wang, Shuifa Sun2026-05-12
🤖 AI

Simulating Complex Multi-Turn Tool Calling Interactions in Stateless Execution Environments

تقدم هذه الورقة DiGiT-TC، وهي طريقة مبتكرة لتوليد البيانات تقوم بتخليق محادثات استدعاء أدوات متعددة الأدوار ومعقدة لبيئات التنفيذ عديمة الحالة من خلال التمثيل الضمني لاستدعاءات الأدوات ضمن طلبات المستخدم، مما يتيح ضبط النماذج اللغوية الأصغر حجمًا بفعالية دون الاعتماد على التحقق من الحالة.

Maxwell Crouse, Ibrahim Abdelaziz, Kshitij Fadnis, Siva Sankalp Patel, Kinjal Basu, Chulaka Gunasekara, Sadhana Kumarave (…)2026-05-12