🤖 AI

Sci-VBench: Evaluating Knowledge- and Reasoning-Intensive Video Generation in Science Domains

تقدم هذه الورقة Sci-VBench، وهو معيار شامل يتكون من 1,253 مثالاً تم تعليمه من قبل خبراء عبر أربعة تخصصات علمية لتقييم قدرات توليد الفيديو كثيفة المعرفة والاستدلال لـ 16 نموذجاً من النماذج الرائدة، كاشفةً أنه بينما تحسنت الواقعية البصرية، لا تزال هناك فجوات كبيرة في الصحة العلمية والسببية، لا سيما بين الأنظمة المملوكة والأنظمة مفتوحة المصدر.

Diandian Zhang, Tingyu Song, Lin Fu, Zheyuan Yang, Yilun Zhao2026-08-11
🤖 AI

ArchAgent v2: A Case Study with the Data Prefetching Championship

تقدم هذه الورقة البحثية ArchAgent v2، وهو إطار عمل وكيل مؤتمت يستخدم البحث التطوري المتتالي والتغذية الراجعة لقابلية التحقيق على الأجهزة لتصميم وحدة استباق بيانات متعددة المستويات تتفوق على الحل المصمم يدويًا والذي فاز في البطولة الرابعة لاستباق البيانات (4th Data Prefetching Championship).

Abraham Gonzalez, Raghav Gupta, Akanksha Jain, Hanna Alam, Alexander Novikov, Po-Sen Huang, Matej Balog, Marvin Eisenber (…)2026-08-11
🤖 AI

DSLE: A Learning Environment for Dark Souls Boss Encounters

تقدم هذه الورقة DSLE، وهي بيئة اختبار معيارية بأسلوب Gymnasium لجميع مواجهات الزعماء الـ 22 في لعبة Dark Souls: Remastered، وتوضح أن أساليب التعلم المعزز والأساليب التطورية الحالية تعاني بشكل كبير في هزيمة حتى مجموعة فرعية ممثلة من هؤلاء الزعماء بسبب المدخلات البصرية عالية الأبعاد، والمكافآت الشحيحة، وآليات القتال المعقدة.

Derin Gezgin, Jim O'Connor, Tanner Goodwin, Gary B. Parker2026-08-11
🤖 AI

GENCO - A Unified Neural Solver Embedded in a Development Framework for Steady-State Grid Analysis

تقدم هذه الورقة GENCO، وهو حلّال عصبي موحد مدمج في إطار تطوير GridFM مفتوح المصدر، والذي يسرع ويحسن بشكل كبير دقة مهام تدفق القدرة في الحالة المستقرة، وتدفق القدرة الأمثل، وتقدير الحالة مقارنة بكل من الحلّالات الكلاسيكية والنهج العصبية الحالية.

Alban Puech, Matteo Mazzonelli, Tamara R. Govindasamy, Mangaliso Mngomezulu, Héctor Maeso-García, Thomas Tolhurst, Javad (…)2026-08-11
💬 NLP

From Values to Benchmarks: Evaluating Large Language Models for Governmental Use in Dutch

تقدم هذه الورقة إطار عمل "السيطرة على النماذج اللغوية الكبيرة" (Grip on LLMs)، وهو مجموعة تقييم شاملة تم تطويرها بالتعاون مع خبراء من البلديات الهولندية لتقييم النماذج اللغوية الكبيرة للاستخدام الحكومي عبر ستة أبعاد رئيسية، كاشفةً أنه لا يوجد نموذج واحد يتفوق في جميع المجالات ومسلطةً الضوء على المقايضات الحاسمة بين الجودة والتكلفة والأثر البيئي.

Laurens Samson, Iva Gornishka, Gossa Lô, Yuki M. Asano, Sennay Ghebreab2026-08-11
💬 NLP

Multimodal Model Diffing for Feature Discovery and Control

تقدم هذه الورقة البحثية MMDiff، وهو إطار عمل لتمييز النماذج متعددة الوسائط (multimodal model-diffing) يستخدم المشفرات التلقائية المتفرقة (sparse autoencoders) لعزل واكتشاف والتحكم السببي في سمات محددة في النماذج اللغوية الكبيرة متعددة الوسائط، مما يتيح تحسينات مستهدفة في الفهم المكاني، والتعرف الضوئي على الحروف (OCR)، والسلامة مع الحفاظ على الأداء العام.

Hunar Batra, Lachin Naghashyar, Ashkan Khakzar, Philip Torr, Christian Schroeder de Witt, Constantin Venhoff, Ronald Cla (…)2026-08-11
💬 NLP

Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions

تقدم هذه الورقة معياراً للتقييم الميتافيزيقي القائم على الأبعاد والمستند إلى الأسس اللغوية لأنظمة تحويل النص إلى كلام، لتكشف أن المقيمات الآلية الحالية، بما في ذلك متنبئات متوسط درجة التفضيل (MOS) وقضاة النماذج اللغوية الكبيرة الصوتية (Audio-LLM)، تفشل في رصد كامل نطاق أبعاد الإدراك الصوتي بما يتجاوز الجودة الصوتية الأساسية بشكل موثوق.

Oluwanifemi Bamgbose, Simon Rosen, Jash Shah, Lindsay Devon Brin, Hoang H Nguyen, Anke Koelzer, Rachel Hansen, Tara Boga (…)2026-08-11
🤖 AI

Towards a Theoretical Understanding of Two Tower Recommendation Models

تقدم هذه الورقة تحليلاً نظرياً لنماذج التوصية ذات البرجين، حيث تثبت ضمانها الإحصائي وتقاربها القوي نحو الأنظمة المثلى، مع إثبات تحقيقها لتقارب أسرع بناءً على أبعاد المدخلات الجوهرية وأداءً فائقاً في كل من التجارب الاصطناعية والتجارب الواقعية.

Amit Kumar Jaiswal2026-08-10
🤖 AI

Harnessing the Synergy between LLM Agents and Knowledge Graphs for Urban Socioeconomic Prediction

تقترح هذه الورقة إطار عمل تآزرياً يدمج وكلاء النماذج اللغوية الكبيرة (LLM) مع الرسوم البيانية للمعرفة لتعزيز التنبؤ بالخصائص الاجتماعية والاقتصادية الحضرية، وذلك عبر الاستفادة من استدلال النماذج اللغوية الكبيرة لتحديد المسارات الوصفية (meta-paths) الخاصة بمهام محددة، وآلية تواصل عبر المهام للدمج المعرفي التكيفي.

Zhilun Zhou, Jingyang Fan, Yu Liu, Fengli Xu, Depeng Jin, Yong Li2026-08-10
🤖 AI

A primer on optimal transport for causal inference with observational data

تقدم هذه الورقة المراجعية الروابط العميقة، والتي غالباً ما يتم التغاضي عنها، بين نظرية النقل الأمثل والاستدلال السببي باستخدام البيانات الرصدية، حيث توضح كيف تدعم مبادئ النقل الأمثل النماذج السببية التأسيسية، وتطمح إلى توحيد المصطلحات عبر التخصصات مع تحديد اتجاهات بحثية جديدة.

Florian F Gunsilius2026-08-10