💻 computer science

Towards Autonomous Aircraft Surveillance from Nanosatellites through On-Board Inference and Generative Data Augmentation

تقترح هذه الورقة سير عمل للمراقبة عبر الأقمار الاصطناعية النانوية ذاتية التحكم يجمع بين الاستدلال الطرفي على متن القمر الاصطناعي وبين تعزيز البيانات التوليدي القائم على نماذج الانتشار للتغلب على قيود عرض نطاق التردد الهابط وعدم توازن الفئات، محققاً معالجة في الوقت الفعلي وتحسناً كبيراً في دقة الكشف عن فئات الطائرات النادرة.

Antonio Delgado-Rosa, David Muñoz-Valero, Enrique Adrian Villarrubia-Martin, Juan Moreno-Garcia2026-07-31
💻 computer science

Selective Credibility-Limited Belief Update

تقدم هذه الورقة "تحديث الاعتقاد الانتقائي المحدود بالمصداقية"، وهو إطار عمل مبتكر يعزز نماذج تحديث الاعتقاد القياسية من خلال تحويل المدخلات المعرفية إلى بدائل أضعف تعتمد على المصدر للسماح بالقبول الانتقائي للأجزاء الموثوقة فقط من المعلومات المركبة، مما يوحد ويعمم بشكل صارم النهجين القائمين على المصداقية المحدودة وكاتسونو-مندلزون.

Theofanis Aravanis, Costas D. Koutras2026-07-31
💻 computer science

What to Remove, What to Preserve: Dual-Ambiguity Rectification for All-in-One Image Restoration

تقترح الورقة البحثية DAR-Net، وهو إطار عمل جديد وشامل لترميم الصور يعالج تحديات الغموض الدلالي والمكاني من خلال تمثيل نمطي للتدهور (Degradation Archetype Representation) ووحدات تصحيح مخصصة، محققاً أداءً هو الأفضل في فئته عبر مختلف معايير قياس التدهور المتنوعة.

Cencen Liu (University of Electronic Science and Technology of China), Wen Yin (University of Electronic Science and Tec (…)2026-07-31
💻 computer science

MANTA: Multi-Agent Network Topology Adaptation for Self-Evolving Multi-Agent Systems

يُعد MANTA إطار عمل مبتكر يُمكّن الأنظمة متعددة الوكلاء من تطوير شبكة اتصالاتها ذاتياً عند وقت الاستنتاج عبر التكيف ديناميكياً مع أدوار الوكلاء، والروابط، وسير العمل بناءً على آثار التعاون، مما يحقق أداءً فائقاً عبر مهام متنوعة ومعقدة مقارنة بالنماذج المرجعية الثابتة أو المحسّنة مسبقاً.

Mao-xun Huang, Jerry Wang, Yi-Cheng Lai, Zhengxin Zhang, Claire Cardie, Hen-Hsen Huang2026-07-31
💬 NLP

ORCA-bench: How Ready Are Language Model Agents for Oncall?

تقدم الورقة البحثية ORCA-bench، وهو معيار قياس ذو دقة إنتاجية لتقييم وكلاء النماذج اللغوية في مهام تحليل الأسباب الجذرية أثناء المناوبات، كاشفةً أن أكثر النماذج المتطورة حالياً تحقق دقة منخفضة (25.3% في الصعوبة المتوسطة) وتواجه صعوبة في الهلوسة، مما يشير إلى وجود فجوة كبيرة قبل إمكانية الوثوق بها بأمان في موثوقية الإنتاج في العالم الحقيقي.

Albert Gong, Kyuseong Choi, Abhineet Agarwal, Jason Schechner, Ryan Huang, Raj Agrawal, Anish Agarwal, Raaz Dwivedi2026-07-31
💻 computer science

Rethinking Inference-Time Scaling in Local Computer-Use Agents: Failure Modes and Compute Tradeoffs

تقدم هذه الورقة دراسة تجريبية منهجية تثبت أنه بينما يمكن لتقنيات التوسع عند وقت الاستدلال، مثل التوسع السياقي والزمني، أن تعمل على استقرار وكلاء استخدام الحاسوب المحليين، إلا أنها غالبًا ما تؤدي إلى عوائد متناقصة وتزيح أنماط الفشل نحو نجاحات سابقة لأوانها، مما يشير إلى أن النشر المحلي الفعال يتطلب تخصيصًا انتقائيًا للحوسبة وآليات تحكم واعية بالفشل بدلاً من التوسع العشوائي.

Woongkyu Lee, Jungwook Choi2026-07-31
💬 NLP

Sample More, Reflect Less: Self-Refine and Reflexion Lose to Repeated Sampling at Equal Token Cost, from 1.5B to 7B

تُثبت هذه الورقة أنه عبر مختلف النماذج مفتوحة المصدر (من 1.5 إلى 7 مليارات معلمة) واختبارات الرياضيات المرجعية، يتفوق أخذ العينات المتكرر باستمرار على أساليب الصقل الذاتي والتفكير المعقد أو يضاهيها عند تقييمها بتكلفة رموز متساوية، مما يكشف أن المكاسب الظاهرية للأخيرة تنبع غالباً من زيادة حجم التوليد بدلاً من استراتيجيات التفكير المتفوقة.

Iliya Mirzaei2026-07-31
💻 computer science

DualG-MRAG: Decoupling Macro-Reasoning and Micro-Matching for Multimodal Retrieval-Augmented Generation

يعالج نظام DualG-MRAG أوجه القصور في أنظمة استرجاع المعلومات المعزز متعدد الوسائط الحالية في مهام الاستدلال المعقدة من خلال تقديم إطار عمل ثنائي المستويات مفكك يفصل بين الاستدلال الهيكلي العالمي (الاستدلال الكلي) وبين المطابقة الدقيقة للأدلة (المطابقة الجزئية) لتقليل ضجيج الاسترجاع وتعزيز دقة الإجابة على الأسئلة من خلال تمرير الرسائل القائم على الرسوم البيانية وفك التشفير باستخدام البرمجة الديناميكية.

Jiacheng Tao, Qingyun Sun, Haonan Yuan, Ziwei Zhang, Jianxin Li2026-07-31
💬 NLP

OSReward: Instituting Standardized Evaluation for Cross-Platform Computer-Use Reward Models

تقدم هذه الورقة البحثية OSReward، وهو معيار شامل يكشف عن أوجه القصور في نماذج الرؤية واللغة الحالية كحكام للوكلاء المستخدمين للحاسوب، وتعالج هذه الفجوة من خلال إطلاق OS-Shepherd، وهي عائلة من نماذج المكافأة المفتوحة ومنخفضة التكلفة والمدربة على مجموعة بيانات جديدة موسومة بالاستدلال تضاهي الأداء التجاري بجزء بسيط من التكلفة.

Qiushi Sun, Kanzhi Cheng, Yian Wang, Bowen Yang, Hang Yan, Liheng Chen, Fangzhi Xu, Zichen Ding, Nuo Chen, Jialin Cao, X (…)2026-07-31
💬 NLP

AISPA: User-Centric System Prompt Auditing for Large Language Model Applications

تقدم هذه الورقة AISPA، وهو إطار عمل متمحور حول المستخدم لتدقيق مطالبات الأنظمة في تطبيقات الذكاء الاصطناعي التجارية، والذي يكشف عن تباين كبير في جودة التصميم، وانتشار التدابير الوقائية الضحلة، والتعايش المستمر للتعليمات الإشكالية التي تقوض مصالح المستخدم رغم الجهود المتزايدة نحو السلامة.

Xiangning Lin, Shenzhe Zhu, Shu Yang, Zhenyu Zhang, Haoqian Zhang, Yipeng Zhao, Chengxuan Qian, Tianwei Wang, Ziheng Zha (…)2026-07-31