🤖 machine learning

Second Order Drifting Models

تقدم هذه الورقة نماذج الانجراف من الدرجة الثانية، التي تعزز ديناميكيات الانجراف بمتغيرات سرعة اصطناعية لتحقيق تسارع شبيه بتسارع نيستروف في فضاء فورييه، مما يتغلب على بطء تقارب الهياكل دقيقة النطاق في نماذج الانجراف من الدرجة الأولى مع الحفاظ على الاستدلال في خطوة واحدة.

Drake Brown, Yuhao Huang, Shih-Hsin Wang, Bao Wang2026-08-11
🤖 AI

REIN: Bridging the Gap between Reasoning and Reliability via Reflection and Abstention Alignment

يُعد REIN إطار عمل للمواءمة يعمل على تعزيز موثوقية نماذج الاستدلال الكبيرة من خلال تدريبها على إجراء تأمل ذاتي صريح والامتناع عن الإجابة عندما تكون المعرفة غير كافية، مما يقلل بشكل كبير من الهلوسة مع الحفاظ على تغطية ودقة عاليتين دون الحاجة إلى أدوات خارجية أو استدلال متعدد الجولات.

Zhengze Huang, Luyang Yu, Di Hong, Xinzhe Huang, Wanyu Lin, Zhixuan Chu, Zhan Qin, Tianhang Zheng2026-08-11
🤖 AI

Locating Failure in Multi-Page Visually Rich Document Understanding: An Empirical Attribution

تعزل هذه الورقة وتُحلل تجريبيًا ثلاثة أنماط من الفشل —التمثيل، والاختيار، والاستدلال— في أنظمة فهم المستندات الغنية بصريًا متعددة الصفحات، كاشفةً أنه بينما تُعد الرؤية ضرورية، فإن أجهزة الاستدلال الحالية تواجه صعوبة في دمج الأدلة عبر الصفحات حتى عندما تكون مُزودة بها بالكامل، مما يقدم توجيهات مستهدفة لتصميم الأنظمة في ظل ميزانيات حوسبة ثابتة.

Lewei Xu, Yihao Ding, Zihan Xu, Daniel Yitian Su, Daochang Liu, Siwen Luo, Yifan Peng, Wei Liu2026-08-11
🤖 AI

Directed Neuro-Symbolic Stochastic Execution for Verification of Distributed Parallel AI Programs

تقدم هذه الورقة إطار عمل "التنفيذ العشوائي العصبي الرمزي الموجه" (DNSSE)، وهو إطار اختبار هجين يجمع بين التنبؤ بالجدولة الموجه بنماذج اللغات الكبيرة (LLM) وبين حل القيود الرمزية والطفرات العشوائية للتحقق بفعالية من برامج الذكاء الاصطناعي المتوازية والموزعة، محققاً تغطية للفروع وكشفاً لأخطاء التزامن أعلى بكثير من النماذج المرجعية الحالية.

Gautham Koorma, Vikas Sharma, George Edwards, Mahdi Eslamimehr2026-08-11
🤖 AI

KGCache: Amortized Subgraph Retrieval for KG Reasoning with LLMs

تقدم هذه الورقة البحثية KGCache، وهو نظام تخزين مؤقت في الذاكرة يعمل على تسريع الإجابة على أسئلة الرسوم البيانية للمعرفة من خلال تخزين وإعادة استخدام بيانات الجوار أحادي القفزة للقضاء على استعلامات الرسم البياني المتكررة، محققاً تسريعاً يصل إلى 1.91 ضعفاً في الاسترجاع و1.06 ضعفاً في أداء النظام الكامل عبر المعايير القياسية.

Uros Stanic, Changcheng Yuan, Sabuj Laskar, Ariful Azad2026-08-11
🤖 AI

Self-Evolving Neuro-Symbolic Skills for Tool-Augmented Spatial Reasoning

تقدم الورقة البحثية NeSy-Spatial، وهو إطار عمل عصبي-رمزي يعزز الاستدلال المكاني من خلال تجريد تفاعلات الأدوات إلى مهارات قابلة لإعادة الاستخدام والتطور الذاتي، والتي يتم تركيبها وتكريرها بشكل تكيفي عبر عملية مغلقة من التنفيذ وتحليل المسار.

Shi-Yu Tian, Zhuo-Xia Wang, Xuan-Yi Zhu, Zhi Zhou, Xinwei Yang, Kun-Yang Yu, Ming Yang, Yang Chen, Yu-Feng Li2026-08-11
🤖 AI

SCOUT: Self-Checking and Recovery-Aware Tool-Thought Agents for Ultra-Long Egocentric Video Reasoning

تقدم الورقة البحثية SCOUT، وهو إطار عمل لوكيل ذاتي الفحص وواعٍ بالاسترداد يستخدم سياسة استكشاف-استغلال تكيفية وطريقة تدريب UPS-GRPO لتحقيق أداء رائد في الاستنتاج عبر فيديوهات المنظور الشخصي فائقة الطول من خلال التخفيف من انتشار الأخطاء وتحسين تخصيص الاعتمادات في سيناريوهات استخدام الأدوات متعددة الخطوات.

Keyang Zhong, Kuo Wang, Peng Liu, Quanlong Zheng, Junlin Xie, Zhijia Liang, Yanhao Zhang, Guanbin Li2026-08-11
🤖 machine learning

EasyBalance: Cross-Layer Load Balancing in Distributed MoE Inference

تُعد EasyBalance استراتيجية موازنة أحمال عبر الطبقات للاستدلال الموزع لنموذج خليط الخبراء (MoE)، والتي تعمل على تخفيف حدة خمول وحدة معالجة الرسومات الناتج عن توزيعات التوجيه غير المتماثلة من خلال جدولة وتأجيل أعباء العمل عبر الطبقات بشكل جشع دون الحاجة إلى تكرار الخبراء أو ترحيلهم أو إجراء تعديلات على تعيين الخبير للجهاز.

Yize Wu, Ke Gao, Ling Li, Yanjun Wu2026-08-11
💬 NLP

Thinking Hard, Not Smart: Reasoning Models Fail to Ration Test-Time Compute Across Questions

تقدم هذه الورقة إطار تقييم يحاكي نمط الامتحانات، يكشف أن نماذج الاستدلال الحالية تفشل في تخصيص ميزانية حوسبة وقت الاختبار المشتركة بشكل استراتيجي عبر أسئلة متعددة، بل تتصرف كحلّالات تسلسلية جشعة تعطي الأولوية لترتيب العرض على حساب صعوبة السؤال أو قيمته.

Chenrui Fan, Yize Cheng, Ming Li, Yongyuan Liang, Tianyi Zhou, Soheil Feizi2026-08-11
💻 computer science

Verication-driven closed-loop multi-agent large language modelframework for code-compliant structural design

تقدم هذه الورقة إطار عمل للنماذج اللغوية الكبيرة متعددة الوكلاء بنظام الحلقة المغلقة القائم على التحقق، والذي يدمج مُحقِّقًا خارجيًا قائمًا على الفيزياء مع آلية إصلاح ثنائية العقد لتحويل انتهاكات الكود إلى قيود قابلة للتنفيذ، مما يحقق زيادة كبيرة في الامتثال للكود وسلامة التصميم الإنشائي مع تقليل استهلاك المواد.

Jianbin Luo, Weibin Lin, Yiran Lin, Qing Wei, Wei Guo2026-08-11