🤖 AI

GRASP: Gated Regression-Aware Skill Proposer for Self-Improving LLM Agents

يُعد GRASP إطار عمل للتحسين الذاتي لوكلاء النماذج اللغوية الكبيرة (LLM)، حيث يقوم بتحديث مكتبة مهارات محدودة بشكل تكراري من خلال قبول مُقيد بناءً على ميزانية تراجع صارمة، مما يعزز الأداء بشكل كبير في المعايير المرجعية السريرية وغير السريرية المنظمة مع منع تدهور السلوكيات المتعلمة سابقاً.

Johannes Moll, Jean-Philippe Corbeil, Jiazhen Pan, Martin Hadamitzky, Daniel Rueckert, Lisa Adams, Keno Bressem2026-05-29
💻 computer science

Spurious Prompts: Can Irrelevant Prompts Steer Large Language Models?

تُثبت هذه الورقة أن المحفزات "الزائفة" غير المرتبطة دلالياً يمكنها توجيه النماذج اللغوية الكبيرة بشكل منهجي إما لتحسين أداء المهام أو لإحداث سلوكيات غير مقصودة، مما يكشف عن شكل جديد من الحساسية للمحفزات يمكن استغلاله عبر البحث في الصندوق الأسود.

Pawel Batorski, Abtin Pourhadi, Jerzy Sarosiek, Przemyslaw Spurek, Paul Swoboda2026-05-29
💻 computer science

Domino: Decoupling Causal Modeling from Autoregressive Drafting in Speculative Decoding

تقترح الورقة البحثية Domino، وهو إطار عمل للفك التشفير الاستنتاجي (speculative decoding) يعمل على فصل نمذجة الاعتماد السببي عن المسودة ذات التوليد الذاتي (autoregressive drafting) عبر الجمع بين هيكل خلفي متوازٍ ورأس تنقيح خفيف الوزن ومنهج تدريبي مرتكز على النموذج الأساسي، محققاً تسريعاً في الإنتاجية يصل إلى 5.8 ضعفاً على نماذج Qwen3.

Jianuo Huang, Yaojie Zhang, Qituan Zhang, Hao Lin, Hanlin Xu, Linfeng Zhang2026-05-29
💻 computer science

Understanding Safety-Sensitive Expert Behavior in Mixture-of-Experts LLMs

تتحدى هذه الورقة البحثية الحدس القائل بأن السلامة في نماذج اللغات الكبيرة ذات "خليط الخبراء" (Mixture-of-Experts) يتم التحكم فيها عبر توجيه الطلبات الضارة إلى خبراء رفض محددين، حيث تثبت بدلاً من ذلك أن سلوك السلامة يتركز في مجموعة فرعية صغيرة من الخبراء ويمكن استهدافه بفعالية عبر إطار عمل RASET المقترح دون تغيير مسارات التوجيه الجوهرية للنموذج.

Zhibo Zhang, Yuxi Li, Zhen Ouyang, Ling Shi, Kailong Wang2026-05-29
💻 computer science

Leveraging Routing Dynamics in Mixture-of-Experts Models for Efficient Language Adaptation

تتقصى هذه الورقة ديناميكيات التوجيه متعدد اللغات في نماذج "خليط الخبراء" (Mixture-of-Experts)، حيث تكشف أن التخصص اللغوي يبرز بشكل أساسي في الطبقات النهائية، وتستفيد من هذه الرؤية لاقتراح استراتيجية تكيف فعالة من حيث المعلمات تُحدّث أقل من 2% من المعلمات مع تحقيق أداء متعدد اللغات تنافسي.

Aditi Khandelwal, Marius Mosbach, Verna Dankers, Siva Reddy, Golnoosh Farnadi2026-05-29
💻 computer science

User-Aware Active Knowledge Acquisition for Emotional Support Dialogue

تقدم هذه الورقة إطار عمل "الاستحواذ النشط على المعرفة الواعي بالمستخدم" (UKA)، وهو إطار عمل خالٍ من التدرج يستفيد من تقدير عدم اليقين القائم على "نظرية العقل" للاستحواذ بنشاط على المعرفة الحوارية واختيار الردود، مما يؤدي إلى تحسين جودة حوار الدعم العاطفي والمواءمة مع المستخدم من خلال المعالجة الفعالة للاحتياجات الضعيفة وغير المباشرة للمستخدم.

Mufan Xu, Kehai Chen, Jiahao Hu, Xinchao Xu, Muyun Yang, Tiejun Zhao, Min Zhang2026-05-29
💻 computer science

HTAM: Hierarchical Transition-Attended Memory for Operator Optimization

تقدم هذه الورقة HTAM، وهو إطار عمل هرمي ينظم خبرة التحسين في رسم بياني للانتقال من الخشن إلى الناعم لتوجيه توليد مشغلات وحدة معالجة الرسومات القائم على النماذج اللغوية الكبيرة، مما يؤدي إلى حل عدم تطابق الدقة وتحسين صحة وأداء النواة بشكل كبير.

Yining Zhang, Mingyang Yi, Chen Wang, Xuwen Xiang, Tianhe Jia, Zedong Dan, Chengqing Zong, Yue Wang2026-05-29
💻 computer science

Minimal Prompt Perturbations Lead to Code Vulnerabilities: Prompt Fragility and Hidden-State Signals in Coding LLMs

تكشف هذه الدراسة أن الاضطرابات الطفيفة، حتى تلك المتمثلة في تغيير حرف واحد في الأوامر، يمكن أن تتسبب في جعل النماذج اللغوية الكبيرة الخاصة بالبرمجة تولد كوداً برمجياً عرضة للثغرات، مع كون عيوب معالجة المدخلات أكثر قابلية للتنبؤ من أخطاء القيم الافتراضية الآمنة من خلال الحالات الخفية، مما يوسع نموذج التهديد الأمني ليتجاوز حقن الأوامر ليشمل التباينات العادية في الأوامر.

Alexander Sternfeld, Andrei Kucharavy, Ljiljana Dolamic2026-05-29
🤖 AI

Multi-Legal-Bench: Evaluating LLMs on Legal Reasoning Across Jurisdictions, Languages, and Legal Traditions

تقدم هذه الورقة البحثية "Multi-Legal-Bench"، وهو أول معيار تقييم عابر للولايات القضائية لتقييم الاستدلال القانوني عبر ست دول وأربع عائلات لغوية، والذي يكشف أن أداء المهام يتباين بشكل كبير حسب الولاية القضائية وأن توافق مجموعة الملصقات، وليس التقارب اللغوي أو كفاءة الرمز (tokenizer)، هو المتنبئ الرئيسي لنجاح نقل التعلم القليل الأمثلة (few-shot transfer) عبر اللغات.

Volodymyr Ovcharov2026-05-29
💻 computer science

AfriScience-MT: Towards Decolonizing Science in Africa through Text Translation

تقدم هذه الورقة البحثية AfriScience-MT، وهو متن متوازٍ من النصوص العلمية عبر ست لغات أفريقية تم إنشاؤه من خلال الترجمة الخبيرة وتطوير المصطلحات، والذي يُستخدم لتقييم أنظمة الترجمة الآلية وإثبات أن النماذج مغلقة المصدر تتفوق حاليًا على البدائل مفتوحة المصدر في ترجمة المحتوى العلمي لهذه اللغات.

Idris Abdulmumin, Tajuddeen Gwadabe, Shamsuddeen Hassan Muhammad, David Ifeoluwa Adelani, Nomonde Khalo, Ibrahim Said Ah (…)2026-05-29