🤖 machine learning

Training Language Models via Neural Cellular Automata

تقترح هذه الورقة استخدام الخلايا الآلية العصبية لتوليد بيانات اصطناعية غير لغوية قابلة للتحكم من أجل مرحلة ما قبل ما قبل التدريب للنماذج اللغوية الكبيرة، مما يثبت أن هذا النهج يحسن الأداء في المهام اللاحقة وسرعة التقارب بشكل كبير مع التفوق على التدريب على مجموعات بيانات لغوية طبيعية أكبر بكثير.

Dan Lee, Seungwook Han, Akarsh Kumar, Pulkit Agrawal2026-03-12
🤖 AI

Tool Receipts, Not Zero-Knowledge Proofs: Practical Hallucination Detection for AI Agents

إن NabaOS هو إطار عمل خفيف الوزن للتحقق في الوقت الفعلي مستوحى من نظرية المعرفة الهندية، يقوم بالكشف عن هلوسات الوكلاء الاصطناعيين عبر تصنيف الادعاءات وفق مصادر معرفية ومطابقتها مع إيصالات الأدوات الموقعة بـ HMAC، محققاً دقة عالية في الكشف مع حد أدنى من زمن الاستجابة مقارنة بطرق الإثبات التشفيري غير العملية.

Abhinaba Basu2026-03-12
🤖 machine learning

Dissecting Chronos: Sparse Autoencoders Reveal Causal Feature Hierarchies in Time Series Foundation Models

تُعد هذه الورقة البحثية رائدة في تطبيق المشفرات التلقائية المتناثرة على نموذج "Chronos-T5" الأساسي للسلاسل الزمنية، حيث تكشف عن تسلسل هرمي سببي يعتمد على العمق، يظهر فيه أن ميزات منتصف المشفر المسؤولة عن كشف التغيير هي أكثر أهمية لدقة التنبؤ من الميزات الغنية دلالياً ولكنها الأقل تأثيراً من الناحية السببية في الطبقة النهائية للمشفر.

Anurag Mishra2026-03-12
🤖 machine learning

Lost in the Middle at Birth: An Exact Theory of Transformer Position Bias

تجادل هذه الورقة بأن ظاهرة "الضياع في المنتصف" في النماذج اللغوية الكبيرة هي خاصية هندسية متأصلة في بنيات فك التشفير السببي عند التهيئة، ناتجة عن التفاعل بين القناع السببي والاتصالات المتبقية الذي يخلق "منطقة ميتة" معادية هيكلياً في منتصف السياق، وهو انحياز يستمر حتى بعد التدريب المسبق القياسي.

Borun D Chowdhury2026-03-12
💬 NLP

The Prediction-Measurement Gap: Toward Meaning Representations as Scientific Instruments

تجادل هذه الورقة بأنه لسد الفجوة بين التنبؤ والقياس في العلوم الاجتماعية الحوسبية، يجب إعادة توجيه تمثيلات النصوص (text embeddings) من التحسين المرتكز على التنبؤ نحو "القابلية للاستخدام العلمي"، مع إعطاء الأولوية للوضوح الهندسي، والقابلية للتفسير، والمتانة لتمكين الاستدلال الدلالي الموثوق والقابل للتتبع.

Hubert Plisiecki2026-03-12
⚡ electrical engineering

Calibration-Reasoning Framework for Descriptive Speech Quality Assessment

تقدم هذه الورقة إطار عمل للمعايرة والاستدلال يقوم بضبط نماذج اللغات الكبيرة الصوتية التأسيسية من خلال مرحلة معايرة والتعلم المعزز القائم على تحسين السياسة النسبي المجموعاتي لتحقيق أداء رائد في تقييم جودة الكلام متعدد الأبعاد، وتحديد مواقع العيوب، والتنبؤ بمتوسط درجة الجودة (MOS).

Elizaveta Kostenok, Mathieu Salzmann, Milos Cernak2026-03-12
💬 NLP

Video-Based Reward Modeling for Computer-Use Agents

تقدم هذه الورقة نموذج مكافأة فيديو التنفيذ (ExeVRM)، وهو إطار عمل قابل للتوسع ومستقل عن النموذج يستفيد من مجموعة بيانات جديدة مكونة من 53 ألف فيديو-مهمة-مكافأة وتقليم الرموز الزماني والمكاني لتقييم مسارات وكلاء استخدام الكمبيوتر بدقة من فيديوهات التنفيذ، متفوقاً بذلك على النماذج المملوكة الرائدة في التنبؤ بنجاح المهمة.

Linxin Song, Jieyu Zhang, Huanxin Sheng, Taiwei Shi, Gupta Rahul, Yang Liu, Ranjay Krishna, Jian Kang, Jieyu Zhao2026-03-12
💬 NLP

Adaptive Activation Cancellation for Hallucination Mitigation in Large Language Models

تقدم هذه الورقة البحثية إطار "إلغاء التنشيط التكيفي" (AAC)، وهو إطار استدلال في الوقت الفعلي وخالٍ من التدريب، يعمل على تخفيف الهلوسة في النماذج اللغوية الكبيرة عبر تحديد وتثبيط التنشيطات العصبية المرتبطة بالهلوسة باعتبارها تداخلاً هيكلياً، مما يؤدي إلى تحسين الدقة الواقعية عبر مقاييس متعددة للنماذج دون تقليل القدرات العامة أو الطلاقة.

Eric Yocam, Varghese Vaidyan, Gurcan Comert, Paris Kalathas, Yong Wang, Judith L. Mwakalonge2026-03-12
💬 NLP

Sabiá-4 Technical Report

يقدم هذا التقرير التقني طرازي Sabi'a-4 وSabiazinho-4، وهما جيل جديد من نماذج اللغة للبرتغالية البرازيلية تتميز بنافذة سياق تبلغ 128 ألف رمز وتدريب متخصص في المهام القانونية والوكيلية، والتي تُظهر كفاءة فائقة من حيث التكلفة والأداء وقدرات في الصياغة القانونية، والحوار، واستخدام الأدوات مقارنة بالأجيال السابقة.

Thiago Laitz, Thales Sales Almeida, Hugo Abonizio, Roseval Malaquias Junior, Giovana Kerche Bonás, Marcos Piau, Celio La (…)2026-03-12
💬 NLP

S-GRADES -- Studying Generalization of Student Response Assessments in Diverse Evaluative Settings

تقدم هذه الورقة البحثية S-GRADES، وهو معيار مرجعي مفتوح المصدر قائم على الويب يوحد 14 مجموعة بيانات متنوعة لاستجابات الطلاب لتمكين التقييم الموحد وكشف فجوات التعميم عبر مهام التصحيح الآلي للمقالات وتصحيح الإجابات القصيرة.

Tasfia Seuti, Sagnik Ray Choudhury2026-03-12