🤖 AI

Hybrid Decision Making via Conformal VLM-generated Guidance

تقدم هذه الورقة البحثية ConfGuide، وهو إطار عمل هجين جديد لاتخاذ القرار يستفيد من التحكم في مخاطر التوافق (conformal risk control) لتوليد توجيهات نصية موجزة ومستهدفة لصناع القرار البشريين، مما يؤدي إلى تحسين جودة القرار وتقليل العبء المعرفي في مهام التشخيص الطبي متعددة الملصقات والمعقدة.

Debodeep Banerjee, Burcu Sayin, Stefano Teso, Andrea Passerini2026-04-17
🤖 machine learning

What Is the Minimum Architecture for Prolepsis? Early Irrevocable Commitment Across Tasks in Small Transformers

تقدم هذه الورقة "الاستباق" (prolepsis)، وهو آلية معمارية في نماذج المحولات الصغيرة حيث تقوم رؤوس انتباه محددة باتخاذ التزامات مبكرة وغير قابلة للتراجع خاصة بمهمة معينة ويتم الحفاظ عليها دون تصحيح، وهي ظاهرة تتكرر عبر نماذج ومهام مختلفة بينما تظل غير مرئية لطرق التفسير القياسية.

Éric Jacopin2026-04-17
🤖 AI

OpenMobile: Building Open Mobile Agents with Task and Trajectory Synthesis

تُعد OpenMobile إطار عمل مفتوح المصدر يعمل على توليد تعليمات مهام ومسارات وكلاء عالية الجودة من خلال خط أنابيب استكشاف قابل للتوسع واستراتيجية تبديل السياسات، مما يمكّن الوكلاء الذين يتم تدريبهم على بياناتها من تحقيق أداء تنافسي في الاختبارات المعيارية للهواتف المحمولة مع ضمان استناد النتائج إلى وظائف واسعة النطاق بدلاً من الإفراط في التخصيص.

Kanzhi Cheng, Zehao Li, Zheng Ma, Nuo Chen, Jialin Cao, Qiushi Sun, Zichen Ding, Fangzhi Xu, Hang Yan, Jiajun Chen, Anh (…)2026-04-17
💬 NLP

IUQ: Interrogative Uncertainty Quantification for Long-Form Large Language Model Generation

تقدم هذه الورقة البحثية "تكميم عدم اليقين الاستفهامي" (IUQ)، وهو إطار عمل مبتكر يستفيد من نموذج "الاستجواب ثم الاستجابة" لتكميم عدم اليقين على مستوى الادعاء والوفاء في توليد النماذج اللغوية الكبيرة طويل الأمد وحر الشكل، متفوقاً بذلك على الأساليب الحالية عبر نماذج ومجموعات بيانات متنوعة.

Haozhi Fan, Jinhao Duan, Kaidi Xu2026-04-17
💬 NLP

Blinded Multi-Rater Comparative Evaluation of a Large Language Model and Clinician-Authored Responses in CGM-Informed Diabetes Counseling

في تقييم أعمى متعدد المقيمين، تفوق نموذج لغوي كبير يعتمد على الاسترجاع على أطباء استشاريين في توليد استجابات إرشادية قائمة على مراقبة الجلوكوز المستمرة تتسم بالتعاطف والقدرة على التنفيذ والأمان، مما يشير إلى إمكاناته كأداة مساعدة في تثقيف المرضى مع تسليط الضوء على الحاجة إلى الإشراف البشري في اتخاذ القرارات العلاجية.

Zhijun Guo, Alvina Lai, Emmanouil Korakas, Aristeidis Vagenas, Irshad Ahamed, Christo Albor, Hengrui Zhang, Justin Healy (…)2026-04-17
🤖 AI

IG-Search: Step-Level Information Gain Rewards for Search-Augmented Reasoning

يُعد IG-Search إطار عمل للتعلم التعزيزي يعمل على تعزيز الاستدلال المعزز بالبحث من خلال تقديم مكافأة "كسب المعلومات" على مستوى الخطوة لتوفير تخصيص دقيق للائتمان لاستعلامات البحث، مما يتغلب على قيود المكافآت على مستوى المسار ويحقق أداءً فائقاً في معايير اختبار الأسئلة والأجوبة دون الحاجة إلى تسميات توضيحية وسيطة.

Zihan Liang, Yufei Ma, Ben Chen, Zhipeng Qian, Huangyu Dai, Lingtao Mao, Xuxin Zhang, Chenyi Lei, Wenwu Ou2026-04-17
💬 NLP

QuantCode-Bench: A Benchmark for Evaluating the Ability of Large Language Models to Generate Executable Algorithmic Trading Strategies

تقدم هذه الورقة QuantCode-Bench، وهو معيار شامل مصمم لتقييم قدرة النماذج اللغوية الكبيرة على توليد استراتيجيات تداول خوارزمية قابلة للتنفيذ لإطار عمل Backtrader، مما يكشف أن النماذج الحالية تعاني أساساً في تشغيل المنطق المالي بشكل صحيح والالتزام بدلالات المهام بدلاً من الصواب النحوي للكود.

Alexey Khoroshilov, Alexey Chernysh, Orkhan Ekhtibarov, Nini Kamkia, Dmitry Zmitrovich2026-04-17
💬 NLP

Compressing Sequences in the Latent Embedding Space: KK-Token Merging for Large Language Models

تقدم هذه الورقة البحثية تقنية "K-Token Merging"، وهي إطار عمل لضغط الفضاء الكامن يقوم بدمج تضمينات الرموز (token embeddings) المتجاورة عبر مشفر خفيف الوزن لتقليل طول المدخلات والتكاليف الحسابية بشكل كبير في النماذج اللغوية الكبيرة مع الحفاظ على أداء عالٍ عبر مهام متنوعة.

Zihao Xu, John Harvill, Ziwei Fan, Yizhou Sun, Hao Ding, Hao Wang2026-04-17
🤖 machine learning

AdaSplash-2: Faster Differentiable Sparse Attention

يقدم AdaSplash-2 تهيئة جديدة تعتمد على المدرج التكراري وتنفيذًا لوحدة معالجة الرسومات مدركًا للتناثر لتسريع انتباه α\alpha-entmax بشكل جذري، مما يتيح سرعات تدريب مقاربة لـ FlashAttention-2 عند مستويات التناثر المتوسطة إلى العالية مع تحقيق أداء فائق في إعدادات السياق الطويل.

Nuno Gonçalves, Hugo Pitorro, Vlad Niculae, Edoardo Ponti, Lei Li, Andre Martins, Marcos Treviso2026-04-17