🤖 AI

El Agente Gráfico: A Semantic Execution Runtime for Scientific Agents

تقدم الورقة البحثية "El Agente Gráfico"، وهو بيئة تشغيل تنفيذ دلالي تستخدم رسومًا بيانية تنفيذية نمطية لفرض انتقالات الحالة العلمية وإثبات المصدر، مما يحسن بشكل كبير من الأداء، وكفاءة التكلفة، والسرعة للوكلاء العلميين المدفوعين بالنماذج اللغوية الكبيرة عبر مهام متنوعة في الكيمياء وعلوم المواد.

Jiaru Bai, Abdulrahman Aldossary, Thomas Swanick, Marcel Müller, Yeonghun Kang, Changhyeok Choi, Naruki Yoshikawa, Zijia (…)2026-08-11
🤖 AI

Controllable Video Object Insertion via Multi-View Priors

تقترح هذه الورقة إطار عمل لإدراج الكائنات في الفيديو يستفيد من مسبقات الكائنات متعددة المشاهد والاشتراط المتسق مع الرؤية للتغلب على القيود في الأساليب الحالية، مثل انحراف الهوية وعيوب الحدود، وبالتالي تحقيق جودة بصرية فائقة، واتساق في الهوية، وتكامل سلس بين المقدمة والخلفية.

Qi Xia, Peishan Cong, Yichen Yao, Ziyi Wang, Yaoqin Ye, Yuexin Ma2026-08-11
🤖 AI

RankGuide: Tensor-Rank-Guided Routing and Steering for Efficient Reasoning

يُعد RankGuide إطار عمل يعزز كفاءة ودقة التعاون بين نماذج الاستدلال الصغيرة (SRM) ونماذج الاستدلال الكبيرة (LRM) من خلال استخدام إشارات رتبة الموتر (tensor-rank signals) المستمدة من الحالات الخفية للكشف عن إخفاقات نماذج الاستدلال الصغيرة من أجل التوجيه التكيفي وتوجيه مسارات الاستدلال، مما يقلل بشكل كبير من زمن انتقال الاستدلال مع الحفاظ على أداء تنافسي.

Jiayi Tian, Yupeng Su, Ryan Solgi, Souvik Kundu, Zheng Zhang2026-08-11
💬 NLP

Path-Lock Expert: Separating Reasoning Mode in Hybrid Thinking via Architecture-Level Separation

تقترح الورقة البحثية "خبير القفل المساري" (Path-Lock Expert - PLE)، وهو حل على مستوى البنية التحتية يستبدل طبقات التغذية الأمامية المفردة بخبيرين مقفلين دلالياً لأنماط استدلال متميزة، مما يقضي فعلياً على تسرب الاستدلال ويحسن الدقة في سيناريوهات عدم التفكير مع الحفاظ على أداء قوي في أنماط التفكير.

Shouren Wang, Wang Yang, Chuang Ma, Debargha Ganguly, Vikash Singh, Chaoda Song, Xinpeng Li, Xianxuan Long, Vipin Chaudh (…)2026-08-11
🤖 machine learning

Alignment Collapse Under KV Cache Quantization: Diagnosis and Mitigation

تكشف هذه الورقة أن تكميم ذاكرة التخزين المؤقت لـ KV منخفض البت يمكن أن يؤدي إلى تدهور صامت في محاذاة سلامة النماذج اللغوية الكبيرة بسبب الضعف الهندسي لميزات السلامة في الفضاءات الفرعية للتنشيط، وتقترح بروتوكول تقليص لكل قناة (PCR) لا يتطلب تدريباً يشخص أوضاع فشل محددة لاستعادة ما يصل إلى 97% من المحاذاة المفقودة مع حد أدنى من الأعباء الإضافية.

Bruce Changlong Xu, Adarsh Kumarappan, Mu Zhou2026-08-11
🤖 AI

Anomaly Detection and Root Cause Analysis for Microservice Systems

تُقدم هذه الأطروحة تقدماً في الكشف التلقائي عن الشذوذ وتحليل الأسباب الجذرية لأنظمة الخدمات المصغرة من خلال معالجة خمسة قيود رئيسية عبر أطر عمل مبتكرة شاملة (BARO، وEventADL، وTORAI) تستفيد من بيانات المراقبة المتنوعة دون الحاجة إلى مخططات استدعاء الخدمات، جنباً إلى جنب مع تقديم معيار RCAEval والتقييم المنهجي لتوحيد الأبحاث المستقبلية.

Luan Pham2026-08-11
🤖 AI

LLM-as-a-Tutor: Policy-Aware Prompt Adaptation for Non-Verifiable RL

تقدم الورقة البحثية إطار عمل "النموذج اللغوي الكبير كمعلم" (LLM-as-a-Tutor)، الذي يعمل على تكييف صعوبة مطالب التدريب ديناميكيًا عبر إلحاق قيود ذرية بالمطالب غير التحديّة، مما يحافظ على إشارة مكافأة تمييزية ويتفوق على الأساليب الحالية في التعلم التعزيزي غير القابل للتحقق لاتباع التعليمات.

Yujin Kim, Namgyu Ho, Sangmin Hwang, Joonkee Kim, Yongjin Yang, Sangmin Bae, Seungone Kim, Jaehun Jung, Se-Young Yun, Hw (…)2026-08-11
🤖 machine learning

Full-Stack FP4: Stable LLM Pretraining with Quantized Projections, Optimizers, and Attention

تقدم هذه الورقة Full-Stack FP4، وهو إطار عمل معياري يوسع نطاق تكميم NVFP4 ليتجاوز عمليات الإسقاط الخطي ليشمل حالات المحسن المستقرة، وحسابات Root/Muon، والاهتمام مختلط الدقة، محققاً أداءً يقارب BF16 في مرحلة ما قبل التدريب مع مكاسب كبيرة في الذاكرة والسرعة على بطاقة RTX 5090 واحدة.

Siyu Ding, Mingchuan Ma, Jiabo Tong, Xingrun Xing, Ziming Wang, Guoqi Li2026-08-11
💬 NLP

UI-MOPD: Multi-Platform On-Policy Distillation for Unified GUI Agents

تقدم هذه الورقة UI-MOPD، وهو إطار عمل مبتكر يستفيد من التقطير متعدد المعلمين في السياسة الموحدة (multi-teacher on-policy distillation) ومن مجموعة بيانات Uni-GUI التي تم إنشاؤها حديثاً لتدريب وكيل واجهة مستخدم رسومية موحد وعابر للمنصات، مما يدمج بفعالية الخبرات المتخصصة في أجهزة المكتب والهواتف المحمولة مع التغلب على التحديات المتعلقة بندرة البيانات واختلاف تقاليد التفاعل.

Niu Lian, Tongbo Chen, Zhehao Yu, Chengzhen Duan, Fazhan Liu, Hui Liu, Pei Fu, Jian Luan, Heng Qu, Shu-Tao Xia, Jinpeng (…)2026-08-11
🤖 AI

Physical AI Governance: From Theory to Practice Across Life Cycle

تقدم هذه الورقة مسحاً شاملاً وإطار حوكمة موحداً للذكاء الاصطناعي الفيزيائي، حيث توضح دورة حياة مكونة من خمس مراحل لتفعيل مبادئ السلامة والموثوقية عبر مجالات البحث، والتصميم، والبيانات، وتطوير النماذج، والنشر.

Wang Yang, Shaobo Wang, Hongxuan Liu, Xiaoran Cai, Yunyu He, Jingzong Zhou, Mengzhong Ma, Yi Yu, Rohit Sharma, Jingjing (…)2026-08-11