💬 NLP

MemSkill: Learning and Evolving Memory Skills for Self-Evolving Agents

تقدم MemSkill إطار عمل ذاتي التطور لوكلاء النماذج اللغوية الكبيرة يستبدل عمليات الذاكرة الثابتة والمصممة يدويًا بمهارات قابلة للتعلم والتكيف، وذلك باستخدام نظام مغلق الحلقة من المتحكمات والمنفذين والمصممين لصقل استراتيجيات إدارة الذاكرة ديناميكيًا وتحسين أداء المهام عبر مختلف المعايšات المرجعية.

Haozhen Zhang, Quanyu Long, Jianzhu Bao, Tao Feng, Weizhi Zhang, Haodong Yue, Wenya Wang2026-05-26
🤖 machine learning

SPA-Cache: Singular Proxies for Adaptive Caching in Diffusion Language Models

تقدم الورقة البحثية SPA-Cache، وهو إطار عمل تخزين مؤقت مبتكر لنماذج اللغات الانتشارية (Diffusion Language Models) يستخدم وسيطاً مفردًا منخفض الأبعاد لتحديد التحديثات بكفاءة واستراتيجية تخصيص ميزانية تكيفية للتغلب على القيود غير السببية، محققاً تحسناً في الإنتاجية يصل إلى 8 أضعاف مقارنة بفك التشفير التقليدي وتسريعاً يتراوح بين 2 إلى 4 أضعاف مقارنة بالنماذج المرجعية الحالية.

Wenhao Sun, Rong-Cheng Tu, Yifu Ding, Zhao Jin, Jingyi Liao, Yongcheng Jing, Dacheng Tao2026-05-26
🧬 biology

Fine-Tuning Language Models to Know What They Know

تقدم هذه الورقة إطار عمل لقياس وتعزيز الإدراك الميتا-معرفي للنماذج اللغوية الكبيرة من خلال توظيف مقياس dtype2d'_{\rm type2} لعزل القدرة الحقيقية واقتراح استراتيجية التطور للمحاذاة الميتا-معرفية (ESMA)، والتي تحقق تعميماً قوياً عبر ظروف متنوعة مع الكشف عن أن التحسينات تنبع من مجموعة نادرة من المعلمات.

Sangjun Park, Elliot Meyerson, Xin Qiu, Risto Miikkulainen2026-05-26
💬 NLP

Agent Primitives: Reusable Latent Building Blocks for Multi-Agent Systems

تقدم هذه الورقة البحثية **النماذج الأولية للوكلاء** (Agent Primitives)، وهو إطار عمل يعمل على تفكيك الأنظمة متعددة الوكلاء إلى لبنات بناء كامنة قابلة لإعادة الاستخدام (المراجعة، والتصويت/الاختيار، والتخطيط/التنفيذ) تتواصل عبر ذاكرة التخزين المؤقت للمفاتيح والقيم لتكوين بنيات مخصصة للمهام تلقائياً، مما يحسن الدقة والكفاءة والاستقرار بشكل كبير مقارنة بالأنظمة متعددة الوكلاء القائمة على النصوص التقليدية.

Haibo Jin, Peng Kuang, Ye Yu, Xiaopeng Yuan, Haohan Wang2026-05-26
🤖 machine learning

Counterfactual Explanations for Hypergraph Neural Networks

تقدم هذه الورقة CF-HyperGNNExplainer، وهي طريقة تفسير مضاد لشبكات الـ Hypergraph Neural Networks تحدد التغييرات الهيكلية الدنيا، مثل إزالة علاقات الحدوث بين العقد والروابط الفائقة (node-hyperedge incidences) أو حذف الروابط الفائقة، لتغيير تنبؤات النموذج وتقديم رؤى قابلة للتفسير حول التفاعلات من الرتب العليا.

Fabiano Veglianti, Lorenzo Antonelli, Gabriele Tolomei2026-05-26
🤖 machine learning

F-GRPO: Don't Let Your Policy Learn the Obvious and Forget the Rare

تقترح الورقة البحثية F-GRPO، وهي طريقة للتعلم التعزيزي مدركة للصعوبة تعمل على التخفيف من ميل الخوارزميات القياسية القائمة على المجموعات نحو الإفراط في ملاءمة الحلول الشائعة وإهمال المسارات الصحيحة النادرة عبر تقليل وزن التحديثات عالية النجاح، مما يؤدي إلى تحسين أداء الاستدلال الرياضي بشكل كبير عبر مختلف النماذج المرجعية دون زيادة التكاليف الحسابية.

Daniil Plyusov, Alexey Gorbatovski, Boris Shaposhnikov, Viacheslav Sinii, Alexey Malakhov, Daria Korotyshova, Daniil Gav (…)2026-05-26
🤖 machine learning

Contextual Rollout Bandits for Reinforcement Learning with Verifiable Rewards

تقترح هذه الورقة "Contextual Rollout Bandits"، وهو إطار جدولة عصبي موحد يعامل عمليات الـ rollout كأذرع bandit سياقية لاختيار وإعادة استخدام البيانات التاريخية ذات القيمة العالية بشكل تكيفي، مما يؤدي إلى تحسين كفاءة العينات والأداء في التعلم التعزيزي مع المكافآت القابلة للتحقق (RLVR) للنماذج اللغوية الكبيرة.

Xiaodong Lu, Xiaohan Wang, Jiajun Chai, Guojun Yin, Wei Lin, Zhijun Chen, Yu Luo, Fuzhen Zhuang, Yikun Ban, Deqing Wang2026-05-26
🤖 AI

FLINGO -- Instilling ASP Expressiveness into Linear Integer Constraints

تقدم هذه الورقة FLINGO، وهي لغة وأداة تعزز برمجة مجموعات الإجابات المقيدة (CASP) من خلال دمج ميزات أساسية لبرمجة مجموعات الإجابات (ASP) — مثل القيم الافتراضية، والسمات غير المعرفة، والتعيينات غير الحتمية، والتجميعات — ضمن القيود الصحيحة الخطية، جنباً إلى جنب مع آلية ترجمة إلى أدوات حل CASP القياسية.

Jorge Fandinno, Pedro Cabalar, Philipp Wanko, Torsten Schaub2026-05-26
📈 economics

Two-Sided Time-Independent Regret for Matching Markets with Limited Interviews

تقدم هذه الورقة آلية تأجيل استراتيجية وتصمم خوارزميات لأسواق المطابقة ثنائية الجانب ذات المقابلات المحدودة، مبرهنةً على أن عدداً ثابتاً من المقابلات في كل جولة يتيح ندمًا غير مرتبط بالزمن لكل من الوكلاء والشركات، مما يحسن بشكل كبير عن حدود O(logT)O(\log T) للنماذج التقليدية.

Amirmahdi Mirfakhar, Xuchuang Wang, Mengfan Xu, Hedyeh Beyhaghi, Mohammad Hajiesmaili2026-05-26
🤖 AI

UniRank: End-to-End Domain-Specific Reranking of Hybrid Text-Image Candidates

يُعد UniRank إطار عمل يعتمد على نماذج الرؤية واللغة الكبيرة (VLM) يقوم بتقييم المرشحين الهجينين من النصوص والصور بشكل أصيل دون تحويل الأنماط، ويستخدم مسار تكييف نطاق ثنائي المراحل يتضمن الضبط الدقيق للتعليمات والتعلم التعزيزي من التغذية الراجحة البشرية القائم على السلبيات الصعبة لتحقيق أداء رائد في مهام إعادة ترتيب الوسائط المتعددة الخاصة بنطاقات محددة.

Yupei Yang, Lin Yang, Wanxi Deng, Lin Qu, Shikui Tu, Lei Xu2026-05-26