💬 NLP

From Interpretability to Control: Insights from Six Years of the TrustNLP Workshop

تجمع هذه الورقة الرؤى المستخلصة من 144 ورقة بحثية عبر ست سنوات من ورشة عمل TrustNLP لتوثيق تطور المجال من التفسير اللاحق إلى التحكم الآلي، مع تسليط الضوء على الصعود السريع في أبحاث الصدق، والمسار الذي يتخذ شكل حرف U بالنسبة للقابلية للتفسير، والتوافق الموضوعي مع اتجاهات معالجة اللغات الطبيعية الأوسع نطاقاً.

Rahul Gupta, Abhinav Mohanty, Anaelia Ovalle, Anil Ramakrishna, Anubrata Das, Apurv Verma, Jwala Dhamala, Ninareh Mehrab (…)2026-08-12
🔢 mathematics

Long-Horizon AI Research for Grothendieck Constant: A Case Study in Human-AI Mathematical Collaboration

تقدم هذه الورقة دراسة حالة حول التعاون بين الإنسان والذكاء الاصطناعي في الرياضيات، توضح كيف نجح نظام أبحاث قائم على الذكاء الاصطناعي في توليد رؤى جديدة لتضييق الحدود المعروفة لثابت غروتينديك مع تقديم تأملات نقدية حول نقاط قوة النظام ونقاط ضعفه والشروط اللازمة لمثل هذه الطفرات النوعية.

Alan Li, Rahul Saha, Anton Xue, Swarat Chaudhuri, Adam Klivans, Pravesh K Kothari, Raghu Meka2026-08-12
💻 computer science

Surgical WAM: A World-Action Model for Data-Efficient Surgical Robot Learning

تقدم الورقة البحثية Surgical WAM، وهو نموذج توليدي يستفيد من فيديوهات التنظير الداخلي الوفيرة والخالية من بيانات الأفعال لتعلم أولويات الديناميكيات البصرية، مما يحسن بشكل كبير من كفاءة البيانات وأداء التحكم في الحلقة المغلقة في مهام الروبوت الجراحي عند ضبطه بدقة باستخدام عروض توضيحية محدودة موسومة بالأفعال.

Wenrui Bao, Tianyun Jiang, Zhiben Chen, Ser-Nam Lim, Peter D. Peng, Yuzhang Shang2026-08-12
🤖 AI

Ethical Framework for Responsible Foundational Models in Medical Imaging

تقترح هذه الورقة إطاراً أخلاقياً شاملاً لتوجيه التطوير والنشر المسؤول لنماذج الذكاء الاصطناعي التأسيسية في التصوير الطبي، معالجةً تحديات حاسمة مثل خصوصية بيانات المرضى، والتحيز الخوارزمي، والحاجة إلى الشفافية والإشراف البشري لضمان رعاية تتمحور حول المريض.

Debesh Jha, Gorkem Durak, Abhijit Das, Jasmer Sanjotra, Onkar Susladkar, Suramyaa Sarkar, Ashish Rauniyar, Nikhil Kumar (…)2026-08-11
💬 NLP

Artificial Leviathan: Exploring Social Evolution of LLM Agents Through the Lens of Hobbesian Social Contract Theory

تُثبت هذه الورقة أن وكلاء النماذج اللغوية الكبيرة، عند وضعهم في بيئة بقاء محاكية، يتطورون طبيعياً من "حالة طبيعة" فوضوية إلى مجتمع منظم ذي سيادة مطلقة، مما يثبت تجريبياً نظرية العقد الاجتماعي لتوماس هوبز ويسلط الضضوء على إمكانات المحاكاة متعددة الوكلاء المدفوعة بالنماذج اللغوية الكبيرة لدراسة الديناميكيات الاجتماعية المعقدة.

Gordon Dai, Weijia Zhang, Jinhan Li, Siqi Yang, Chidera Onochie lbe, Srihas Rao, Arthur Caetano, Misha Sra2026-08-11
🤖 AI

Discriminative and Consistent Representation Distillation

تقترح هذه الورقة طريقة تقطير التمثيل التمييزي والمتسق (DCD)، وهي طريقة تعزز تقطير المعرفة من خلال الجمع بين التمييز النوعي التبايني وبين حد التنظيم المتسق ومعلمات قابلة للتعلم لتحقيق أداء تنافسي في مهام التصنيف والكشف مع القضاء على الحاجة إلى بنوك ذاكرة خارجية وتقليل العبء التدريبي.

Nikos Giakoumoglou, Tania Stathaki2026-08-11
🤖 AI

A Rigorous Turing Test: a Foundation for Evaluating Artificial General Intelligence

تجادل هذه الورقة بأن الادعاءات القائلة باجتياز النماذج اللغوية الكبيرة لاختبار تورينج سابقة لأوانها، حيث كشف تطبيق صارم وغير مقيد للعبة التقليد الأصلية الخاصة بتورينج أن الحكام البشر استطاعوا بسهولة التمييز بين الذكاء الاصطناعي والإنسان، على خلاف الدراسات السابقة التي ربما استخدمت حدوداً زمنية أقصر.

Sharon Temtsin, Diane Proudfoot, David Kaber, Christoph Bartneck2026-08-11
⚡ electrical engineering

LF2{}^{2}AR: Accounting for Layerwise Dynamics to Improve Multimodal Adaptation of Language Models

تقدم الورقة البحثية LF2{}^{2}AR، وهي بنية مبتكرة تعمل على تحسين التكيف متعدد الوسائط للنماذج اللغوية من خلال الاستفادة من ديناميكيات التجريد والتحسين عبر الطبقات عبر دمج الوسائط المتأخر، والانشطار المتأخر مع البواقي الانتباهية، وآليات الوصول الانتقائي، مما يؤدي إلى تعزيز المحاذاة عبر الوسائط، وأداء الاستدلال، وفك التشفير بكفاءة عند الخروج المبكر.

Santiago Cuervo, Adel Moumen, Yanis Labrak, Sameer Khurana, Antoine Laurent, Mickael Rouvier, Phil Woodland, Ricard Marx (…)2026-08-11
🤖 AI

LEGO-Puzzles: How Good Are MLLMs at Multi-Step Spatial Reasoning?

تقدم الورقة البحثية LEGO-Puzzles، وهو معيار لتقييم قدرات الاستدلال المكاني متعدد الخطوات لنماذج اللغات الكبيرة متعددة الوسائط (MLLMs) من خلال مهام أولية وتخطيط التجميع، كاشفةً أن حتى أقوى النماذج لا تزال أداؤها ضعيفاً بشكل ملحوظ مقارنة بالبشر وتكافح للحفاظ على الدقة مع زيادة تعقيد التخطيط.

Kexian Tang, Junyao Gao, Yanhong Zeng, Haodong Duan, Yanan Sun, Zhening Xing, Wenran Liu, Kai Chen, Kaifeng Lyu2026-08-11
🤖 machine learning

TreeHop: Efficient Embedding-Level Query Rewriter

يُعد TreeHop إطار عمل مبتكرًا على مستوى التضمين (embedding-level) للإجابة على الأسئلة متعددة القفزات (multi-hop) ولا يعتمد على النماذج اللغوية الكبيرة (LLM-free)، حيث يقوم ديناميكيًا بدمج المعلومات الدلالية من الاستعلامات السابقة والمستندات المسترجعة لتبسيط عملية الاسترجاع، محققًا أداءً يضاهي الأساليب المتطورة مع تقليل التكاليف الحسابية وزمن الاستجابة بشكل جذري.

Zhonghao Li, Kunpeng Zhang, Jinghuai Ou, Shuliang Liu, Xuming Hu2026-08-11