💻 computer science

What to Remove, What to Preserve: Dual-Ambiguity Rectification for All-in-One Image Restoration

تقترح الورقة البحثية DAR-Net، وهو إطار عمل جديد وشامل لترميم الصور يعالج تحديات الغموض الدلالي والمكاني من خلال تمثيل نمطي للتدهور (Degradation Archetype Representation) ووحدات تصحيح مخصصة، محققاً أداءً هو الأفضل في فئته عبر مختلف معايير قياس التدهور المتنوعة.

Cencen Liu (University of Electronic Science and Technology of China), Wen Yin (University of Electronic Science and Tec (…)2026-07-31
💻 computer science

MANTA: Multi-Agent Network Topology Adaptation for Self-Evolving Multi-Agent Systems

يُعد MANTA إطار عمل مبتكر يُمكّن الأنظمة متعددة الوكلاء من تطوير شبكة اتصالاتها ذاتياً عند وقت الاستنتاج عبر التكيف ديناميكياً مع أدوار الوكلاء، والروابط، وسير العمل بناءً على آثار التعاون، مما يحقق أداءً فائقاً عبر مهام متنوعة ومعقدة مقارنة بالنماذج المرجعية الثابتة أو المحسّنة مسبقاً.

Mao-xun Huang, Jerry Wang, Yi-Cheng Lai, Zhengxin Zhang, Claire Cardie, Hen-Hsen Huang2026-07-31
💬 NLP

ORCA-bench: How Ready Are Language Model Agents for Oncall?

تقدم الورقة البحثية ORCA-bench، وهو معيار قياس ذو دقة إنتاجية لتقييم وكلاء النماذج اللغوية في مهام تحليل الأسباب الجذرية أثناء المناوبات، كاشفةً أن أكثر النماذج المتطورة حالياً تحقق دقة منخفضة (25.3% في الصعوبة المتوسطة) وتواجه صعوبة في الهلوسة، مما يشير إلى وجود فجوة كبيرة قبل إمكانية الوثوق بها بأمان في موثوقية الإنتاج في العالم الحقيقي.

Albert Gong, Kyuseong Choi, Abhineet Agarwal, Jason Schechner, Ryan Huang, Raj Agrawal, Anish Agarwal, Raaz Dwivedi2026-07-31
💻 computer science

Rethinking Inference-Time Scaling in Local Computer-Use Agents: Failure Modes and Compute Tradeoffs

تقدم هذه الورقة دراسة تجريبية منهجية تثبت أنه بينما يمكن لتقنيات التوسع عند وقت الاستدلال، مثل التوسع السياقي والزمني، أن تعمل على استقرار وكلاء استخدام الحاسوب المحليين، إلا أنها غالبًا ما تؤدي إلى عوائد متناقصة وتزيح أنماط الفشل نحو نجاحات سابقة لأوانها، مما يشير إلى أن النشر المحلي الفعال يتطلب تخصيصًا انتقائيًا للحوسبة وآليات تحكم واعية بالفشل بدلاً من التوسع العشوائي.

Woongkyu Lee, Jungwook Choi2026-07-31
💬 NLP

Sample More, Reflect Less: Self-Refine and Reflexion Lose to Repeated Sampling at Equal Token Cost, from 1.5B to 7B

تُثبت هذه الورقة أنه عبر مختلف النماذج مفتوحة المصدر (من 1.5 إلى 7 مليارات معلمة) واختبارات الرياضيات المرجعية، يتفوق أخذ العينات المتكرر باستمرار على أساليب الصقل الذاتي والتفكير المعقد أو يضاهيها عند تقييمها بتكلفة رموز متساوية، مما يكشف أن المكاسب الظاهرية للأخيرة تنبع غالباً من زيادة حجم التوليد بدلاً من استراتيجيات التفكير المتفوقة.

Iliya Mirzaei2026-07-31
💻 computer science

DualG-MRAG: Decoupling Macro-Reasoning and Micro-Matching for Multimodal Retrieval-Augmented Generation

يعالج نظام DualG-MRAG أوجه القصور في أنظمة استرجاع المعلومات المعزز متعدد الوسائط الحالية في مهام الاستدلال المعقدة من خلال تقديم إطار عمل ثنائي المستويات مفكك يفصل بين الاستدلال الهيكلي العالمي (الاستدلال الكلي) وبين المطابقة الدقيقة للأدلة (المطابقة الجزئية) لتقليل ضجيج الاسترجاع وتعزيز دقة الإجابة على الأسئلة من خلال تمرير الرسائل القائم على الرسوم البيانية وفك التشفير باستخدام البرمجة الديناميكية.

Jiacheng Tao, Qingyun Sun, Haonan Yuan, Ziwei Zhang, Jianxin Li2026-07-31
💬 NLP

OSReward: Instituting Standardized Evaluation for Cross-Platform Computer-Use Reward Models

تقدم هذه الورقة البحثية OSReward، وهو معيار شامل يكشف عن أوجه القصور في نماذج الرؤية واللغة الحالية كحكام للوكلاء المستخدمين للحاسوب، وتعالج هذه الفجوة من خلال إطلاق OS-Shepherd، وهي عائلة من نماذج المكافأة المفتوحة ومنخفضة التكلفة والمدربة على مجموعة بيانات جديدة موسومة بالاستدلال تضاهي الأداء التجاري بجزء بسيط من التكلفة.

Qiushi Sun, Kanzhi Cheng, Yian Wang, Bowen Yang, Hang Yan, Liheng Chen, Fangzhi Xu, Zichen Ding, Nuo Chen, Jialin Cao, X (…)2026-07-31
💬 NLP

AISPA: User-Centric System Prompt Auditing for Large Language Model Applications

تقدم هذه الورقة AISPA، وهو إطار عمل متمحور حول المستخدم لتدقيق مطالبات الأنظمة في تطبيقات الذكاء الاصطناعي التجارية، والذي يكشف عن تباين كبير في جودة التصميم، وانتشار التدابير الوقائية الضحلة، والتعايش المستمر للتعليمات الإشكالية التي تقوض مصالح المستخدم رغم الجهود المتزايدة نحو السلامة.

Xiangning Lin, Shenzhe Zhu, Shu Yang, Zhenyu Zhang, Haoqian Zhang, Yipeng Zhao, Chengxuan Qian, Tianwei Wang, Ziheng Zha (…)2026-07-31
💬 NLP

AskChem: Claim-Centered Infrastructure for Chemistry Literature Synthesis

تُعد AskChem بنية تحتية جديدة تُحدث تحولاً في تركيب الأدبيات الكيميائية عبر نقل عملية الاسترجاع من الوثائق الكاملة إلى ادعاءات ذرية حاملة للمصدر، مما يُمكّن من بحث واكتشاف أكثر دقة وقابلية للتحقق والوصول عبر الذكاء الاصطناعي بين الأوراق البحثية المختلفة.

Bing Yan, Gregory Wolfe, Stefano Martiniani, Kyunghyun Cho2026-07-31
🤖 machine learning

ReToken: One Token to Improve Vision-Language Models for Visual Retrieval

تُعد ReToken عبارة عن تضمين واحد خفيف الوزن وقابل للتعلم، يعمل بكفاءة على استرجاع الرموز البصرية ذات الصلة بالاستعلام من ذاكرة التخزين المؤقت (KV cache) المعبأة مسبقاً، مما يحسن بشكل كبير أداء نماذج الرؤية واللغة في مهام استرجاع الصور والفيديوهات ذات السياق الطويل مع بقائه ممكناً من الناحية الحسابية على وحدة معالجة رسوميات واحدة.

Yao Xiao, Reuben Tan, Zhen Zhu, Yuqun Wu, Jianfeng Gao, Derek Hoiem2026-07-31