🤖 AI

Intern-S2-Mobius: Foundation Model with Decoupled Knowledge and Reasoning

تقدم الورقة البحثية Intern-S2-Mobius، وهي بنية نموذج تأسيسي تفصل بين تخزين المعرفة في وحدة ذاكرة مشتركة وبين الاستدلال التركيبي التكراري في أدوات استدلال مخصصة، محققة أداءً مماثلاً لنماذج Transformer المرجعية مع تقليل بيانات التدريب بشكل كبير وسرعة استنتاج تبلغ 4 أضعاف تقريباً.

Kai Chen, Jifeng Ding, Ning Ding, Jiaye Ge, Lixin Gu, Yicheng Gu, Qipeng Guo, Ermo Hua, Haian Huang, Haozheng Hou, Jie H (…)2026-08-17
⚡ electrical engineering

Sensor-Driven Mission Synthesis for UAV/UGV Swarms: A TB-CSPN Coordination Architecture with Hardware-Enforced Safety

تقترح هذه الورقة بنية تنسيق قائمة على (TB-CSPN) لأسراب الطائرات بدون طيار والمركبات الأرضية غير المتجانسة، تعمل على دمج بيانات الاستشعار متعددة الأنماط في إجراءات مهمة قابلة للتدقيق مع ضمان السلامة المفروضة عتادياً من خلال أغلفة تناظرية مستقلة للتخفيف من المخاطر الناجمة عن عدم اليقين البيئي والتهديدات السيبرانية.

Uwe M. Borghoff, Paolo Bottoni, Remo Pareschi2026-08-17
💬 NLP

A Four-Axis Trustworthiness Benchmark for LLM-as-Judge in Principle-Based Regulation

تقدم هذه الورقة البحثية Principle-Bench، وهو معيار مرجعي جديد يغطي الدقة، ومتانة إعادة الصياغة، والمتانة الخصومية، والمعايرة لتقييم أنظمة "النموذج اللغوي الكبير كحكم" (LLM-as-judge) في التنظيم القائم على المبادئ، مما يكشف عن معاناة النماذج الحالية من ثغرات "مسرح الامتثال" حيث يؤدي حشو الكلمات المفتاحية الخصومي بشكل جذري إلى خفض الأداء ويسلط الضوء على الحاجة الماسة إلى آليات تقييم معايرة وقابلة للتدقيق.

Dipankar Sarkar2026-08-17
🤖 AI

Wrong but Useful: Trajectory Value Beyond Answer Correctness in Multi-Agent Messages

تقدم هذه الورقة بروتوكول المداولة على الفرضيات المتنوعة (DHD) لإثبات أن الرسائل غير الصحيحة في أنظمة الاستنتاج متعددة الوكلاء غالباً ما تمتلك "قيمة مسار" كبيرة من خلال مساعدة الحلّالين اللاحقين، مما يثبت أن صحة الإجابة وحدها معيار غير كافٍ لتصفية اتصالات الوكلاء.

Chih-Hsuan Yang, Anjir Ahmed Chowdhury, Cheng-Hau Yang, Weijian Zheng, Fernando Llorente, Xiaolong Ma, Xinyang Li, Eliu (…)2026-08-17
🤖 AI

GBU-Palm: A Multimodal Video Dataset and Benchmark for Palm Presentation Attack Detection

تقدم هذه الورقة البحثية GBU-Palm، وهي مجموعة بيانات ومعيار للفيديو متعدد الوسائط واسع النطاق يضم 21,326 عينة متزامنة من الأشعة المرئية (RGB) والأشعة تحت الحمراء القريبة (NIR) عبر بيئات متنوعة، وذلك لتقييم وكشف أوجه القصور في طرق الكشف الحالية عن هجمات تقديم كف اليد تحت ظروف البيئات المتقاطعة بشكل منهجي.

Yingjie Ma, Zitong Yu, Wei Jia, Ajay Kumar, Linlin Shen2026-08-17
🔢 mathematics

AI-Assisted Discovery and Construction of a Counterexample to the Convergence of Three-Block ADMM with the Identity Matrix as its Third Constraint Block

تحل هذه الورقة البحثية المسألة المفتوحة حول ما إذا كان خوارزمية "أدما" (ADMM) ثلاثية الكتل تتقارب عندما تكون كتلة القيد الثالثة هي مصفوفة الوحدة، وذلك باستخدام سير عمل مدعوم بالذكاء الاصطناعي لإنشاء أمثلة مضادة عقلانية صريحة تثبت عدم التقارب، مع تحليل الظروف التي يمكن من خلالها استعادة التقارب عبر استرخاء المضاعف.

Kenan Xu, Xiangfeng Wang2026-08-17
🤖 AI

LLMs Don't Pay for the Jump

تجادل هذه الورقة بأن النماذج اللغوية الكبيرة لا يمكنها القيام بالاستدلال الاستنباطي الحقيقي لأن استنتاج المحولات ذات الأوزان الثابتة، على عكس الاختراقات العلمية التاريخية التي كانت مدفوعة بالتكلفة المادية للخطأ المعرفي، يفتقر إلى آلية تترتب فيها تكاليف ثيرموديناميكية على مثل هذه الأخطاء لفرض المراجعة المفاهيمية.

Paras Balani, Subhrakanta Panda2026-08-17
🤖 AI

From Style Replication to Style Exploration: Enabling Art Style Exploration with Analyze-Experiment-Resituate Framework

تقدم هذه الورقة إطار عمل "التحليل-التجريب-إعادة التموضع" (AER)، المستمد من ممارسات الفنانين المحترفين والمثبت من خلال الدراسات المستخدمة، بهدف نقل أدوات الذكاء الاصطنا quite التوليدي من مجرد محاكاة الأنماط نحو دعم قدرة الفنانين على الاستكشاف، والتجريب، والتأمل في توجهات فنية جديدة.

Wen-Fan Wang, TsaiHsuan Lin, Chi-Lan Yang, An-Ru Cheng, Bing-Yu Chen2026-08-17
🤖 AI

The Past and Future of AI Scientists

تستعرض هذه الورقة تطور والإمكانات المستقبلية للعلماء المتكاملين المعتمدين على الذكاء الاصطناعي —وهي أنظمة قادرة على توليد الفرضيات، وتصميم التجارب، وتحقيق اكتشافات جديدة— محاجةً بأنه في حين أن المكونات العلمية الفردية أصبحت قابلة للأتمتة بالفعل، فإن التحدي الحاسم يكمن في دمجها لتحقيق "تحدي نوبل تورينج" المتمثل في أتمتة اكتشافات بجودة نوبل بحلول عام 2050.

Ross D. King2026-08-17
🤖 AI

Knowing When to Stop: Bayesian Optimal Stopping for LLM Evaluations

تقدم هذه الورقة البحثية **optstop**، وهو إطار عمل بايزي للتوقف التكيفي يقوم بتخصيص ميزانيات أخذ العينات ديناميكيًا بناءً على عدم اليقين بدلاً من الأعداد الثابتة، مما يمكّن تقييمات النماذج اللغوية الكبيرة من خفض التكاليف الحسابية بنسبة تتراوح بين 57% و97% مع الحفاظ على استنتاجات متكافئة.

Toby D. Pilditch2026-08-17