🤖 machine learning

Socially Grounded Agentic AI: Coordinating Plural Perspectives through Social Theory

تجادل هذه الورقة بأن التوافق التعددي الفعال للذكاء الاصطناعي الوكيل يتطلب تجاوز مجرد تنويع المخرجات عبر الاستفيد من النظرية الاجتماعية لتصميم أنظمة تنسق هيكلياً بين وجهات نظر متعددة ومشروعة من خلال تمثيلات قائمة على الأدوار، والمداولة الواعية بالتفاعل، والتقييم الحساس للسياق.

Matt Ratto, Abhishek Moturu, Daniel Silver2026-08-05
💻 computer science

Implementing Causal Perception: Competing SCMs and Situated Fairness

تقدم هذه الورقة أول تنفيذ عملي لإطار الإدراك السببي من خلال تشغيل الخلافات الهيكلية والبارامترية بين النماذج السببية الهيكلية للوكلاء، مبرهنةً من خلال مجموعة بيانات الائتمان الألماني أن مثل هذه الرؤى المتنافسة للعالم تغير بشكل كبير تقييمات العدالة ونتائج القرارات في البيئات متعددة الخبراء.

Jose M. Álvarez2026-08-05
💻 computer science

When and Where to Look: Adaptive Visual Evidence Scheduling for Efficient Long Video Understanding

تقدم الورقة البحثية EcoFrame، وهو إطار عمل لا يتطلب تدريباً يعزز فهم الفيديوهات الطويلة بكفاءة من خلال الجدولة التكيفية للأدلة المرئية عبر توسيع الميزانية المعتمد على الإنتروبيا والبحث عن المرشحين الموجه بالانتباه، محققاً توازناً متفوقاً بين الدقة والكفاءة مقارنة بالطرق الاستاتيكية والطرق القائمة على الوكلاء الحالية.

Ke Li, Jiayu Chen, Maoliang Li, Zihao Zheng, Hailong Zou, Hengyi Zhang, Xuanzhe Liu, Xiang Chen2026-08-05
💻 computer science

Equivariant Music Transformer

تقدم هذه الورقة نموذج "إيكوفاريانت ميوزيك ترانسفورمر" (EMT)، وهو نموذج يفرض التكافؤ (equivariance) تجاه الإزاحات الزمنية والتحويلات النغمية من خلال التقطير الذاتي والتنظيم المساعد، مما يتغلب على قيود نماذج "ترانسفورمر" القياسية التي تفشل في التقاط التناظرات الانتقالية للموسيقى، ويُظهر أداءً توليدياً وجودة تمثيل متفوقة.

Zixun Guo, Simon Dixon2026-08-05
🤖 machine learning

PRISM: Powerful Time Series to Image (TS2I) Representations for Multivariate Anomaly Detection

تقدم الورقة البحثية PRISM، وهو سير عمل ميتا (meta-workflow) يعمل بشكل منهجي على تحويل السلاسل الزمنية متعددة المتغيرات إلى صور متعددة القنوات للكشف عن الشذوذ، مما يثبت أن التمثيلات القائمة على الصور المصممة جيداً مع استراتيجيات التشكيل في قنوات مبتكرة ومشفرات رؤية مدربة مسبقاً يمكن أن تتفوق بشكل كبير على النماذج المرجعية التقليدية في المجال الزمني.

Mateusz Smendowski, Kamil Faber, Piotr Nawrocki, Nathalie Japkowicz, Roberto Corizzo2026-08-05
💬 NLP

Logic Before Language: Pre-pretraining on Formal Derivations Fosters Skill Acquisition and Compressibility

تقدم هذه الورقة البحثية Logic-PPT، وهي استراتيجية ما قبل تدريب (pre-pretraining) تستخدم الاشتقاقات الصورية التي تسرع اكتساب مهارات اللغة الطبيعية وتستحث فضاء تمثيل منخفض الرتبة ومركز طيفياً، مما يتيح قدرة فائقة للنموذج على الانضغاط مقارنة بالتهيئة القياسية.

Jo-Ku Cheng, Nikolaos Aletras, Marco Valentino2026-08-05
💻 computer science

TACT: Taxonomy-Aligned Post-Training for Pedagogically Adaptive English Tutoring

تقدم هذه الورقة البحثية إطار عمل TACT، وهو إطار عمل مرتكز على العنصر البشري يستفيد من التصنيفات التربوية لبناء مجموعة بيانات متخصصة وإعادة تدريب نموذج لغوي كبير (LLM) لاحقاً، مما ينتج عنه نموذج TACTutor الذي يتفوق بشكل كبير على النماذج المرجعية الحالية في التدريس التربوي التكيفي للغة الإنجليزية مع الحفاظ على القدرات التعليمية العامة.

Dongjie Yang, Siyan Lin, Leixian Shen, Rui Sheng, Huamin Qu, Zixin Chen2026-08-05
💻 computer science

A game theory for foundation models shows new paths to rational cooperation through similarity inference

تقترح هذه الورقة إطاراً جديداً قائماً على نظرية الألعاب لوكلاء النماذج التأسيسية بناءً على "الوكالة المضمنة"، حيث تُظهر أن قدرتهم على استنتاج التشابه السلوكي تتيح لهم تحقيق تعاون مستقر في المعضلات الاجتماعية، مما يقلب التوقعات الكلاسيكية للتعاون المتبادل بالخيانة.

Alexander Meulemans, Maciej Wołczyk, Marissa A. Weis, Rajai Nasser, Roberta Rocca, Seijin Kobayashi, Guillaume Lajoie, A (…)2026-08-05
💻 computer science

Interpretable Adaptive Sampling for LLM Test-Time Scaling

تقترح هذه الورقة إطار عمل للعينات التكيفية القابلة للتفسير لتوسيع نطاق زمن الاختبار في النماذج اللغوية الكبيرة، والذي يستخدم متحكمًا ضبابيًا خفيف الوزن لتخصيص ميزانيات الحوسبة ديناميكيًا بناءً على تعقيد المطالبة وثقة النموذج، مما يؤدي إلى تحسين كفاءة الاستدلال والشفافية مقارنة بالنماذج المرجعية الثابتة أو غير الشفافة.

Mobina Kashaniyan, Ali Jannesari2026-08-05
💻 computer science

Should We Type or Talk to LLM Agents? A Comprehensive Study of Voice and Keyboard Input Perturbations

تقدم هذه الورقة البحثية HIVE، وهي مجموعة اختبار للاضطرابات تُظهر أن أخطاء النسخ الصوتي تضعف أداء النماذج اللغوية الكبيرة بشكل كبير من خلال تعطيل بنية الرموز (tokens) وإعاقة التفكير، بينما يسهل استيعاب أخطاء الكتابة بلوحة المفاتيح، مما يكشف أن الحفاظ على الرموز الأصلية أمر بالغ الأهمية لمتانة النماذج وأن التدريب القياسي أو ميزانيات التفكير تفشل في التخفيف من نقاط الضعف الخاصة بالصوت بشكل كامل.

Zizhao Hu, Nathan Elijah Segura, Mohammad Rostami, Jesse Thomason2026-08-05