🤖 AI

FlowSteer: Towards Agents Designing Agentic Workflows via Reinforced Progressive Canvas Editing

يُعد FlowSteer إطار عمل مبتكر يُمكّن عميلاً واحداً من تصميم سير عمل وكيلِيّ قابل للتنفيذ من البداية إلى النهاية من خلال نموذج تحرير لوحة تقدمي معزز، مستفيداً من التغذية الراجعة اللحظية على مستوى الرسم البياني للتغلب على التحديات المتمثلة في البناء المعتمد على البشر وإصلاح الأخطاء أثناء الحلقة.

Mingda Zhang, Wenjin Liu, Tiesunlong Shen, Qika Lin, Rui Mao, Erik Cambria, Xiaoying Tang, Haoran Luo2026-05-15
💻 computer science

Dynamic Mixed-Precision Routing for Efficient Multi-step LLM Interaction

تقترح هذه الورقة البحثية "التوجيه الديناميكي متعدد الدقة" (DMR)، وهو إطار عمل يختار بشكل تكيفي بين النماذج اللغوية الكبيرة ذات الدقة العالية والمنخفضة عند كل خطوة قرار باستخدام مسار تدريب ثنائي المراحل لتحقيق التوازن الأمثل بين الدقة والتكلفة في المهام متعددة الخطوات طويلة المدى.

Yuanzhe Li, Jianing Deng, Jingtong Hu, Tianlong Chen, Song Wang, Huanrui Yang2026-05-15
🤖 machine learning

Conformal Thinking: Risk Control for Reasoning on a Compute Budget

تقترح هذه الورقة إطاراً للتحكم في المخاطر غير المعتمد على التوزيع لضبط ميزانيات الرموز (tokens) التكيفية بشكل أمثل باستخدام عتبات عليا ودنيا مبتكرة لتقليل تكاليف الحوسبة مع الالتزام الصارم بمعدل خطأ يحدده المستخدم.

Xi Wang, Anushri Suresh, Alvin Zhang, Rishi More, William Jurayj, Benjamin Van Durme, Mehrdad Farajtabar, Daniel Khashab (…)2026-05-15
🤖 AI

Proximal Action Replacement for Behavior Cloning Actor-Critic in Offline Reinforcement Learning

تقدم هذه الورقة البحثية تقنية استبدال الإجراءات القريبة (PAR)، وهي أداة قابلة للتركيب والتشغيل تعمل على استبدال عينات التدريب، وتتغلب على سقف الأداء الذي تفرضه طرق "الممثل-الناقد" المنظمة بـ "نسخ السلوك" في التعلم المعزز غير المتصل، وذلك من خلال استبدال إجراءات مجموعة البيانات دون المثالية بأخرى محسنة مسترشدة بصعود دالة القيمة، مما يعزز الأداء باستمرار عبر الاختبارات المرجعية.

Jinzong Dong, Wei Huang, Jianshu Zhang, Zhuo Chen, Xinzhe Yuan, Qinying Gu, Zhaohui Jiang, Nanyang Ye2026-05-15
🤖 AI

Finding Interpretable Prompt-Specific Circuits in Language Models

تقدم هذه الورقة البحثية ACC++، وهي طريقة محسنة لتتبع الدوائر (circuit-tracing) تستخرج دوائر انتباه قابلة للتفسير وخاصة بكل مطالبة (prompt-specific) من تمريرة أمامية واحدة، مما يكشف عن كيفية استخدام النماذج اللغوية لإشارات متميزة ومعتمدة على اللغة لحل مهام مثل تحديد المفعول به غير المباشر عبر سياقات لغوية مختلفة.

Gabriel Franco, Lucas M. Tassis, Azalea Rohr, Mark Crovella2026-05-15
🤖 AI

Numerical exploration of the range of shape functionals using neural networks

تقدم هذه الورقة إطاراً عددياً مبتكراً يجمع بين تمثيل شبكة عصبية قابلة للعكس للأجسام المحدبة ونظام جسيمات متفاعل لاستكشاف وعينات منتظمة من مخططات بلاشكي-سانتالو لمختلف الدوال الشكلية الهندسية والقائمة على المعادلات التفاضلية الجزئية في البعدين والثلاثة أبعاد بكفاءة.

Eloi Martinet, Ilias Ftouhi2026-05-15
🤖 AI

Hunt Globally: Wide Search AI Agents for Drug Asset Scouting in Investing, Business Development, and Competitive Intelligence

لمعالجة الفجوة الحرجة في تحديد الأصول الدوائية غير الأمريكية المخفية في المصادر الإقليمية متعددة اللغات، تقترح هذه الورقة "عميلًا بصريًا مزدوجًا" (Bioptic Agent) متخصصًا ومنهجية قياس مرجعية صارمة تحقق استدعاءً ودقةً فائقين مقارنة بنماذج الذكاء الاصطناعي الرائدة في مجال البحث العميق في قطاعي الاستثمار وتطوير الأعمال الصيدلانية.

Vlad Vinogradov, Alisa Vinogradova, Luba Greenwood, Ilya Yasny, Dmitry Kobyzev, Shoman Kasbekar, Kong Nguyen, Dmitrii Ra (…)2026-05-15
🤖 AI

Grokking Finite-Dimensional Algebra

توسع هذه الورقة البحثية دراسة ظاهرة "الاستيعاب العميق" (grokking) من العمليات الجماعية إلى الجبر العام ذي الأبعاد المحدودة، مظهرةً كيف تؤثر الخصائص الجبرية وسمات التنسور الهيكلية على الانتقال من مرحلة الحفظ إلى مرحلة التعميم في الشبكات العصبية.

Pascal Jr Tikeng Notsawo, Guillaume Dumas, Guillaume Rabusseau2026-05-15
🤖 AI

CausalReasoningBenchmark: A Real-World Benchmark for Disentangled Evaluation of Causal Identification and Estimation

تقدم الورقة البحثية CausalReasoningBenchmark، وهو مجموعة بيانات من واقع الحياة تضم 173 استعلاماً صُممت لتقييم خطوتي التحديد والتقدير في الاستدلال السببي بشكل منفصل، مما يكشف أن النماذج اللغوية الكبيرة الحالية تعاني مع التفاصيل الدقيقة لتصميم الأبحاث أكثر من مع الحسابات العددية.

Ayush Sawarni, Jiyuan Tan, Vasilis Syrgkanis2026-05-15
🤖 machine learning

Robometer: Scaling General-Purpose Robotic Reward Models via Trajectory Comparisons

تقدم الورقة البحثية Robometer، وهو إطار عمل قابل للتوسع لنمذجة المكافأة يجمع بين الإشراف على التقدم على مستوى الإطار مع تعلم التفضيل القائم على مقارنة المسارات، والذي تم تدريبه على مجموعة بيانات RBM-1M واسعة النطاق لتعلم دالات مكافأة قابلة للتعميم بفعالية من مسارات خبيرة وغير مثالية متنوعة.

Anthony Liang, Yigit Korkmaz, Jiahui Zhang, Minyoung Hwang, Abrar Anwar, Sidhant Kaushik, Aditya Shah, Alex S. Huang, Lu (…)2026-05-15