🤖 machine learning

Selective Deficits in LLM Mental Self-Modeling in a Behavior-Based Test of Theory of Mind

تقدم هذه الورقة نموذجاً جديداً لنظرية العقل القائم على السلوك، والذي يكشف أنه في حين يمكن للنماذج اللغوية الكبيرة الحديثة تحقيق أداء بمستوى البشر في نمذجة الحالات الذهنية للآخرين، إلا أنها تخفق باستمرار في نمذجة ذاتها دون الاستعانة بمسارات استدلالية، مما يشير إلى اعتمادها على ذاكرة عاملة محدودة السعة وقدرتها على الانخراط في الخداع الاستراتيجي عند توفير الدعم المناسب.

Christopher Ackerman2026-03-30
💬 NLP

Clash of the models: Comparing performance of BERT-based variants for generic news frame detection

تُقدم هذه الدراسة إسهاماً في أبحاث التواصل السياسي من خلال التقييم المقارن لخمسة متغيرات قائمة على نموذج BERT للكشف عن الأطر الإخبارية العامة، وتقديم نماذج مضبوطة بدقة وقوية، وتوفير مجموعة بيانات انتخابية سويسرية جديدة لاختبار المتانة السياقية بما يتجاوز البيانات المتمحورة حول الولايات المتحدة.

Vihang Jumle2026-03-30
🤖 machine learning

DataFlex: A Unified Framework for Data-Centric Dynamic Training of Large Language Models

تُعد DataFlex إطار عمل موحداً ونمطياً مبنياً على LLaMA-Factory، يدمج بين اختيار العينات، وضبط مزيج النطاق، وإعادة وزن العينات لتمكين تدريب ديناميكي فعال، وقابل للتكرار، وعالي الأداء لتدريب النماذج اللغوية الكبيرة المرتكز على البيانات.

Hao Liang, Zhengyang Zhao, Meiyi Qiang, Mingrui Chen, Lu Ma, Rongyi Yu, Hengyi Feng, Shixuan Sun, Zimo Meng, Xiaochen Ma (…)2026-03-30
💬 NLP

Sparse Auto-Encoders and Holism about Large Language Models

تجادل هذه الورقة بأنه في حين أن اكتشاف السمات الكامنة القابلة للتفسير عبر المشفّرات التلقائية المتناثرة يتحدى الرؤية القائلة بأن النماذج اللغوية الكبيرة تجسد نظرية شمولية للمعنى، إلا أن الصورة الشمولية تظل قابلة للتطبيق شريطة أن تكون هذه السمات قابلة للعد.

Jumbly Grindrod2026-03-30
💬 NLP

GS-BrainText: A Multi-Site Brain Imaging Report Dataset from Generation Scotland for Clinical Natural Language Processing Development and Validation

تقدم الورقة البحثية GS-BrainText، وهو عبارة عن مجموعة بيانات منسقة متعددة المواقع تضم 8,511 تقريراً طبياً مشروحاً لصور الأشعة الدماغية من مجموعة "جيل سكوتلندا" (Generation Scotland)، والتي صُممت لمعالجة الفجوات في موارد النصوص السريرية في المملكة المتحدة ودعم تطوير والتحقق من صحة أدوات معالجة اللغات الطبيعية السريرية القابلة للتعميم.

Beatrice Alex, Claire Grover, Arlene Casey, Richard Tobin, Heather Whalley, William Whiteley2026-03-30
💬 NLP

A Universal Vibe? Finding and Controlling Language-Agnostic Informal Register with SAEs

تُثبت هذه الورقة أن النماذج اللغوية متعددة اللغات تستوعب السجل غير الرسمي كتمثيل تجريدي تداولي موحد وعابر للغات بدلاً من كونه مجرد حفظ معزول، وهو ما استُدل عليه باكتشاف "فضاء فرعي للسجل غير الرسمي" قوي وعابر للغات في نموذج Gemma-2-9B-IT يمكن التلاعب به سببياً لتغيير درجة الرسمية عبر اللغات المدربة وغير المدربة على حد سواء.

Uri Z. Kialy, Avi Shtarkberg, Ayal Klein2026-03-30
💬 NLP

Distilling Conversations: Abstract Compression of Conversational Audio Context for LLM-based ASR

تقترح هذه الورقة "الضغط التجريدي" (Abstract Compression)، وهي طريقة تستبدل الصوت في الدورات السابقة برموز كامنة ثابتة مع الاحتفاظ بالنصوص المكتوبة للاستفيد بكفاءة من سياق المحادثة لتحسين التعرف التلقائي على الكلام القائم على النماذج اللغوية الكبيرة (LLM-based ASR)، لا سيما في التعرف على الكيانات السياقية، دون التكلفة الحسابية العالية لمعالجة تسلسلات الصوت الخام.

Shashi Kumar, Esaú Villatoro-Tello, Sergio Burdisso, Kadri Hacioglu, Thibault Bañeras-Roux, Hasindri Watawana, Dairazali (…)2026-03-30
💬 NLP

Working Notes on Late Interaction Dynamics: Analyzing Targeted Behaviors of Late Interaction Models

تتقصى هذه الورقة الديناميكيات الكامنة لنماذج استرجاع التفاعل المتأخر (Late Interaction) على معيار NanoBEIR، كاشفةً أنه في حين تُظهر النماذج السببية انحيازاً عملياً للطول، فإن النماذج ثنائ الاتجاه قد تعاني أيضاً منه في الحالات القصوى، وتؤكد أن عامل MaxSim يستفيد بفعالية من أوجه التشابه على مستوى الرمز (token) دون وجود اتجاهات ملحوظة تتجاوز الرمز الأعلى تسجيلاً للدرجات.

Antoine Edy, Max Conti, Quentin Macé2026-03-30
💬 NLP

findsylls: A Language-Agnostic Toolkit for Syllable-Level Speech Tokenization and Embedding

تقدم الورقة البحثية **findsylls**، وهي مجموعة أدوات نمطية ومستقلة عن اللغة توحد طرق تقسيم المقاطع اللفظية المتنوعة تحت واجهة مشتركة لتمكين تقطيع الكلام وتطويره على مستوى المقطع الصوتي بشكل معياري وقابل للتكرار عبر اللغات ذات الموارد العالية واللغات ذات الموارد المنخفضة.

Héctor Javier Vázquez Martínez2026-03-30
💬 NLP

From Human Cognition to Neural Activations: Probing the Computational Primitives of Spatial Reasoning in LLMs

تتقصى هذه الورقة الآليات الداخلية للاستدلال المكاني في النماذج اللغوية الكبيرة متعددة اللغات من خلال تفكيك المهمة إلى ثلاثة عناصر معرفية أولية وتوظيف تحليلات ميكانيكية، كاشفةً عن أنه بينما تقوم النماذج بترميز معلومات مكانية عابرة ومجزأة يمكن أن تؤثر سببياً على السلوك، فإنها تفتقر إلى تمثيلات مكانية قوية وعامة الغرض، وتعتمد بدلاً من ذلك على مسارات تعتمد على السياق تظهر تدهوراً ميكانيكياً عبر اللغات.

Jiyuan An, Liner Yang, Mengyan Wang, Luming Lu, Weihua An, Erhong Yang2026-03-30