💬 NLP

TARAZ: Persian Short-Answer Question Benchmark for Cultural Evaluation of Language Models

تقدم هذه الورقة البحثية TARAZ، وهو معيار جديد للإجابات القصيرة باللغة الفارسية وإطار تقييم هجين يتغلب على قيود خيارات متعددة ومقاييس المطابقة التامة الحالية لتقييم الكفاءة الثقافية للنماذج اللغوية الكبيرة بشكل أكثر دقة من خلال التطبيع الصرفي وتسجيل التشابه الدلالي.

Reihaneh Iranmanesh, Saeedeh Davoudi, Pasha Abrishamchian, Ophir Frieder, Nazli Goharian2026-03-17
💬 NLP

LLM Novice Uplift on Dual-Use, In Silico Biology Tasks

تُظهر هذه الدراسة أن الوصول إلى النماذج اللغوية الكبيرة يُمكّن المستخدمين المبتدئين بشكل كبير من التفوق على المبتدئين الذين يعتمدون على الإنترنت فقط، وفي بعض الحالات على الخبراء البيولوجيين، في المهام المتعلقة بالأمن الحيوي، بينما تكشف أيضاً أن الضمانات الحالية غير كافية لمنع الحصول على معلومات مزدوجة الاستخدام.

Chen Bo Calvin Zhang, Christina Q. Knight, Nicholas Kruus, Jason Hausenloy, Pedro Medeiros, Nathaniel Li, Aiden Kim, Yur (…)2026-03-17
💬 NLP

A Comprehensive Evaluation of LLM Unlearning Robustness under Multi-Turn Interaction

تكشف هذه الورقة أن نسيان الآلة في النماذج اللغوية الكبيرة غالباً ما يفشل في تحقيق محو قوي للمعرفة في الإعدادات التفاعلية الواقعية متعددة الجولات، حيث يمكن استعادة المعلومات المنسية من خلال التصحيح الذاتي والاستعلام المشروط بالحوار، مما يشير إلى أن التقييمات الثابتة الحالية تبالغ بشكل كبير في تقدير الفعالية في العالم الحقيقي.

Ruihao Pan, Suhang Wang2026-03-17
💬 NLP

A Gauge Theory of Superposition: Toward a Sheaf-Theoretic Atlas of Neural Representations

تقترح هذه الورقة إطار عمل قياسي يعتمد على نظرية الحزم (sheaf-theoretic) لتفسير التراكب في النماذج اللغوية الكبيرة عبر استبدال القواميس العالمية بخرائط دلالية محلية، مما يسمح بقياس ثلاثة عوائق محددة أمام القابلية للتفسير — وهي الحشر المحلي (local jamming)، وقص الوكيل (proxy shearing)، والتحول غير البديهي (nontrivial holonomy) — والتحقق من هذه الحدود النظرية من خلال تجارب تجريبية على نموذج Llama-3.2-3B.

Hossein Javidnia2026-03-17
🤖 machine learning

Translational Gaps in Graph Transformers for Longitudinal EHR Prediction: A Critical Appraisal of GT-BEHRT

تُقيّم هذه الورقة البحثية بشكل نقدي نموذج (GT-BEHRT) القائم على المحولات الرسومية للتنبؤ بالسجلات الصحية الإلكترونية الطولية، مع الإقرار بأدائه التمييزي القوي وتقدمه المعماري، وفي الوقت ذاته تسلط الضوء على فجوات ترجمية جوهرية في المعايرة والعدالة وجدوى النشر يجب معالجتها قبل الاعتماد السريري.

Krish Tadigotla2026-03-17
💬 NLP

KazakhOCR: A Synthetic Benchmark for Evaluating Multimodal Models in Low-Resource Kazakh Script OCR

تقدم هذه الورقة KazakhOCR، وهو معيار مرجعي اصطناعي لتقييم النماذج متعددة الوسائط في النصوص الكازاخستانية منخفضة الموارد بالنماذج العربية والسيريلية واللاتينية، مما يكشف أن النماذج اللغوية الكبيرة متعددة الوسائط الحالية تقصر بشكل كبير مقارنة بطرق التعرف الضوئي على الحروف التقليدية، لا سيما في التعرف على النصوص العربية واللاتينية وتحديد اللغة بشكل صحيح.

Henry Gagnier, Sophie Gagnier, Ashwin Kirubakaran2026-03-17
💬 NLP

Explain in Your Own Words: Improving Reasoning via Token-Selective Dual Knowledge Distillation

تقدم هذه الورقة البحثية تقنية تقطير المعرفة المزدوجة الانتقائية للرموز (TSD-KD)، وهي إطار عمل يرتكز على الطالب يجمع بين التغذية الراجعة غير المباشرة القائمة على التفضيل وبين مطابقة التوزيع الانتقائية على مستوى الرمز لمساعدة النماذج الأصغر على تجاوز قيود السعة وتحقيق أداء استدلالي رائد، يتجاوز في كثير من الأحيان نماذج المعلم الخاصة بها.

Minsang Kim, Seung Jun Baek2026-03-17
💬 NLP

Tracing the Evolution of Word Embedding Techniques in Natural Language Processing

تقدم هذه الورقة مراجعة منهجية شاملة وتحليلاً ببليومترياً قائماً على البيانات لـ 149 مقالاً بحثياً من عام 1954 إلى عام 2025، تتبع تطور تقنيات تضمين الكلمات وتحدد كمياً تحولاً جذرياً في النماذج ما بعد GPT-3 نحو الأساليب السياقية، وفرق التعاون الأكبر، وأولويات البحث الجديدة المدفوعة من قبل الصناعة.

Minh Anh Nguyen, Kuheli Sai, Minh Nguyen2026-03-17
🤖 machine learning

From Gradients to Riccati Geometry: Kalman World Models for Single-Pass Learning

تقدم هذه الورقة نماذج عالم كالمان (Kalman World Models)، وهو إطار عمل خالٍ من التدرج يستبدل الانتشار العكسي بالترشيح البايزي المتكرر وتكييف كسب كالمان لتمكين التدريب عبر الإنترنت، القوي لنماذج فضاء الحالة والمحولات، استناداً إلى نظرية التحكم.

Andrew Kiruluta2026-03-17
🤖 machine learning

Resolving Interference (RI): Disentangling Models for Improved Model Merging

تقترح الورقة البحثية إطار عمل "حل التداخل" (Resolving Interference - RI)، وهو إطار عمل خفيف الوزن يستخدم بيانات مساعدة غير مصنفة لفك تشابك النماذج الخبيرة إلى مساحات متعامدة وظيفياً، مما يقلل من تداخل المهام المتبادل ويحسن بشكل كبير أداء وتعميم دمج النماذج دون الحاجة إلى بيانات خاصة بكل مهمة.

Pratik Ramesh, George Stoica, Arun Iyer, Leshem Choshen, Judy Hoffman2026-03-17