💻 computer science

Evaluating LLM-Simulated Conversations in Modeling Inconsistent and Uncollaborative Behaviors in Human Social Interaction

تقدم هذه الورقة CoCoEval، وهو إطار عمل للكشف عن السلوكيات غير المتسقة وغير التعاونية في المحادثات التي تحاكيها النماذج اللغوية الكبيرة، وتجد أن النماذج الحالية تكافح لمحاكاة تعقيد التفاعل الاجتماعي البشري بشكل أصيل بسبب الفروق الجوية الكبيرة في تكرار السلوك، وعدم موثوقية هندسة الأوامر، وميل الضبط الدقيق إلى إنتاج أنماط سلوكية ضيقة.

Ryo Kamoi, Ameya Godbole, Longqi Yang, Rui Zhang, Mengting Wan, Pei Zhou2026-03-19
💻 computer science

Multilingual Reference Need Assessment System for Wikipedia

تقدم هذه الورقة نظام تعلم آلي متعدد اللغات مصمم لمساعدة محرري ويكيبيديا في تحديد الادعاءات التي تتطلب استشهادات عبر 10 نسخ لغوية، مع موازنة دقة النموذج مع الكفاءة الحسابية في ظل القيود الواقعية مع التفوق على المعايير المرجعية الحالية.

Aitolkyn Baigutanova, Francisco Navas, Pablo Aragon, Mykola Trokhymovych, Muniza Aslam, Ai-Jou Chou, Miriam Redi, Diego (…)2026-03-19
🧬 biology

Tabular LLMs for Interpretable Few-Shot Alzheimer's Disease Prediction with Multimodal Biomedical Data

يقدم البحث نموذج TAP-GPT، وهو نموذج لغوي كبير للبيانات الجدولية متكيف مع المجال، يستفيد من التعلم بلقطات قليلة والاستدلال المهيكل لتحقيق تنبؤ دقيق وقابل للتفسير ومتين لمرض الزهايمر باستخدام بيانات طبية حيوية متعددة الوسائط، متفوقاً بذلك على النماذج التقليدية لتعلم الآلة في سيناريوهات مجموعات البيانات الصغيرة أو غير المكتملة.

Sophie Kearney, Shu Yang, Zixuan Wen, Weimin Lyu, Bojian Hou, Duy Duong-Tran, Tianlong Chen, Jason H. Moore, Marylyn D. (…)2026-03-19
🤖 machine learning

Abstraction as a Memory-Efficient Inductive Bias for Continual Learning

تقترح هذه الورقة التدريب المعزز بالتجريد (AAT)، وهو أسلوب تعلم مستمر موفر للذاكرة يعمل على استقرار التعلم عبر الإنترنت ومنع النسيان الكارثي من خلال تشجيع النماذج على التقاط البنى العلاقاتية الكامنة المشتركة، مما يحقق أداءً مقارناً لإعادة تشغيل الخبرة دون الحاجة إلى ذاكرة تخزين مؤقت لإعادة التشغيل.

Elnaz Rahmati, Nona Ghazizadeh, Zhivar Sourati, Nina Rouhani, Morteza Dehghani2026-03-19
🤖 machine learning

Catching rationalization in the act: detecting motivated reasoning before and after CoT via activation probing

تُثبت هذه الورقة أن سبر تنشيطات النماذج الداخلية يمكنه اكتشاف الاستدلال المدفوع بشكل أكثر موثوقية من تحليل سلاسل التفكير التي تولدها النماذج اللغوية الكبيرة، حيث تتيح مجسات ما قبل التوليد تحديد السلوك المنحاز في وقت مبكر قبل إنتاج أي استدلال.

Parsa Mirtaheri, Mikhail Belkin2026-03-19
🤖 machine learning

OPERA: Online Data Pruning for Efficient Retrieval Model Adaptation

إنَّ OPERA هو إطار عمل لتقليم البيانات يعزز كفاءة وفعالية تكييف نماذج الاسترجاع الخاصة بمجالات معينة من خلال توظيف استراتيجية تقليم ديناميكية ثنائية المرحلة لحل المقايضة بين الجودة والتغطية، محققاً أداءً فائقاً في التصنيف والاستدعاء في أقل من نصف وقت التدريب المستخدم في الضبط الدقيق القياسي.

Haoyang Fang, Shuai Zhang, Yifei Ma, Hengyi Wang, Cuixiong Hu, Katrin Kirchhoff, Bernie Wang, George Karypis2026-03-19
💻 computer science

Alignment Makes Language Models Normative, Not Descriptive

تُظهر هذه الورقة أنه بينما يعمل محاذاة ما بعد التدريب على تحسين النماذج اللغوية للاستخدام البشري، فإنه يحولها جوهرياً من كونها نماذج وصفية سلوكية تمثل السلوك البشري الفعلي في التفاعلات الاستراتيجية المعقدة متعددة الجولات، إلى نماذج تنبؤية معيارية تتفوق فقط في الإعدادات التي تتوافق فيها الخيارات البشرية مع الحلول المثالية.

Eilam Shapira, Moshe Tennenholtz, Roi Reichart2026-03-19
🤖 machine learning

TharuChat: Bootstrapping Large Language Models for a Low-Resource Language via Synthetic Data and Human Validation

تقدم هذه الورقة TharuChat، وهي مجموعة بيانات اصطناعية تم إنشاؤها من خلال مسار تمهيدي من نموذج لغوي كبير إلى بشري لتدريب Tharu-LLaMA (3B)، وهو نموذج متخصص في اتباع التعليمات يعالج بفعالية ندرة البيانات والتجزئة اللهجية للغة ثارو ذات الموارد المنخفضة باستخدام أجهزة استهلاكية.

Prajwal Panth, Agniva Maiti2026-03-19
💬 NLP

From Words to Worlds: Benchmarking Cross-Cultural Cultural Understanding in Machine Translation

تقدم هذه الورقة CulT-Eval، وهو معيار شامل وتصنيف للأخطاء لتقييم تعامل الترجمة الآلية مع التعبيرات ذات الجذور الثقافية، كاشفةً أن النماذج الحالية تعاني في التعامل مع الفروق الثقافية الدقيقة ومقترحةً مقياساً جديداً لمعالجة هذه القصور.

Bangju Han, Yingqi Wang, Huang Qing, Tiyuan Li, Fengyi Yang, Ahtamjan Ahmat, Abibulla Atawulla, Yating Yang, Xi Zhou2026-03-19
🤖 machine learning

Contrastive Reasoning Alignment: Reinforcement Learning from Hidden Representations

تقترح الورقة البحثية إطار عمل CRAFT، وهو إطار محاذاة مبتكر يعزز متانة نماذج الاستدلال الكبيرة ضد هجمات كسر الحماية من خلال الاستفادة من التعلم التبايني والتعلم المعزز لتحسين أهداف السلامة مباشرة داخل فضاء التمثيل الخفي، مما يحقق أداءً فائقاً على الدفاعات الرائدة حالياً.

Haozheng Luo, Yimin Wang, Jiahao Yu, Binghui Wang, Yan Chen2026-03-19