🤖 AI

Infinite Mask Diffusion for Few-Step Distillation

تقترح هذه الورقة نموذج انتشار القناع اللانهائي (IMDM)، الذي يستخدم قناعاً عشوائياً ذا حالة لانهائية للتغلب على حد خطأ التفكيك النظري لنماذج الانتشار المقنعة القياسية، مما يتيح تقطيراً فعالاً لعدد قليل من الخطوات وأداءً فائقاً في مهام توليد النصوص بعدد قليل من الخطوات.

Jaehoon Yoo, Wonjung Kim, Chanhyuk Lee, Seunghoon Hong2026-05-12
🤖 AI

Measuring Embedding Sensitivity to Authorial Style in French: Comparing Literary Texts with Language Model Rewritings

تتقصى هذه الورقة مدى قدرة تضمينات النماذج اللغوية الفرنسية على التقاط واستبقاء السمات الأسلوبية للمؤلف بعد إعادة الكتابة، مبرهنةً على أن هذه الإشارات تستمر وتُظهر أنماطاً خاصة بكل نموذج، مما يفتح آفاقاً جديدة للكشف عن محاكاة التأليف.

Benjamin Icard, Lila Sainero, Alice Breton, Evangelia Zve, Jean-Gabriel Ganascia2026-05-12
🤖 machine learning

MulTaBench: Benchmarking Multimodal Tabular Learning with Text and Image

تقدم هذه الورقة MulTaBench، وهو معيار شامل يتكون من 40 مجموعة بيانات صور-جدولية ونصوص-جدولية صُممت لإثبات أن الضبط الدقيق المخصص للمهام لتمثيلات الوسائط غير المهيكلة يتفوق بشكل كبير على التمثيلات المجمدة، مما يؤسس لقاعدة لتطوير نماذج تأسيسية جدولية متعددة الوسائط ومبتكرة.

Alan Arazi, Eilam Shapira, Shoham Grunblat, Mor Ventura, Elad Hoffer, Gioia Blayer, David Holzmüller, Lennart Purucker (…)2026-05-12
🤖 AI

Interpretable Coreference Resolution Evaluation Using Explicit Semantics

تقدم هذه الورقة إطار تقييم معزز دلاليًا لحل الإحالة المرجعية، يقوم بدمج التعرف على المفاهيم والكيانات المسماة لتوفير رؤى تشخيصية دقيقة ومحددة بالفئات، مما يكشف عن نقاط الضعف المنهجية في النماذج ويسمح باستراتيجيات تعزيز البيانات المستهدفة التي تحسن الأداء خارج نطاق البيانات الأصلية.

Bruno Gatti, Giuliano Martinelli, Roberto Navigli2026-05-12
🤖 AI

Intrinsic Guardrails: How Semantic Geometry of Personality Interacts with Emergent Misalignment in LLMs

تُثبت هذه الورقة أن الهندسة الدلالية المستقرة لفضاء الشخصية في النماذج اللغوية الكبيرة تحتوي على حواجز حماية جوهرية، مثل متجه شخصية "الشر" ومتجه التكافؤ الدلالي المُستحدث، واللذين يمكن استخراجهما من النماذج المتوافقة ونقلهما دون تدريب مسبق (zero-shot) لكبح عدم التوافق الناشئ في عمليات الضبط الدقيق الفاسدة بفعالية.

Krishak Aneja, Manas Mittal, Anmol Goel, Ponnurangam Kumaraguru, Vamshi Krishna Bonagiri2026-05-12
🤖 machine learning

A Single-Layer Model Can Do Language Modeling

تقدم هذه الورقة شبكات التنبؤ المرتكزة (GPN)، وهي بنية تكرارية أحادية الطبقة تحقق أداءً تنافسياً في نمذجة اللغة من خلال إعادة زيارة متجه حالة واحد عند كل خطوة، مما يقدم بديلاً مستوحىً بيولوجياً للنماذج العميقة المتراكمة مع تمكين الفحص الهندسي المباشر لديناميكيات ذاكرتها الداخلية.

Zanmin Wang2026-05-12
🤖 AI

Prompt-Activation Duality: Improving Activation Steering via Attention-Level Interventions

تقدم هذه الورقة البحثية تقنية "Gated Cropped Attention-Delta" (GCAD)، وهي طريقة مبتكرة لتوجيه التنشيط تعمل على تخفيف تلوث ذاكرة الـ KV-cache في الحوارات المستمرة عبر استخراج وتنسيق إشارات التوجيه من مساهمات "البرومبت النظامي" (system-prompt) في آلية الانتباه الذاتي، مما يؤدي إلى تحسين التماسك طويل الأمد بشكل كبير مع الحفاظ على التحكم في الشخصية.

Diancheng Kang, Zheyuan Liu, Ningshan Ma, Yue Huang, Zhaoxuan Tan, Meng Jiang2026-05-12
🤖 AI

Why Low-Resource NLP Needs More Than Cross-Lingual Transfer: Lessons Learned from Luxembourgish

تجادل هذه الورقة بأن معالجة اللغات الطبيعية المستدامة للموارد المنخفضة تتطلب نهجاً تكميلياً يجمع بين النقل عبر اللغات والجهود الخاصة بكل لغة، مستعرضةً من خلال دراسة حالة اللغة اللوكسمبورغية أن النماذج متعددة اللغات تحتاج إلى بيانات مستهدفة عالية الجودة ومتوافقة مع المهام للوصول إلى كامل إمكاناتها.

Fred Philippy, Siwen Guo, Jacques Klein, Tegawendé F. Bissyandé2026-05-12
🔬 physics

Conformity Generates Collective Misalignment in AI Agents Societies

تُثبت هذه الورقة أن مجموعات من وكلاء الذكاء الاصطناعي المتوافقين فردياً يمكن أن تنحرف جماعياً نحو حالات مستقرة من عدم التوافق بسبب ديناميكيات الامتثال، مما يكشف أن ضمانات السلامة الفردية لا تضمن السلامة الجماعية ويسلط الضوء على خطر نقاط التحول غير القابلة للانعكاس المدفوعة بالتأثير الاجتماعي.

Giordano De Marzo, Alessandro Bellina, Claudio Castellano, Viola Priesemann, David Garcia2026-05-12
📊 statistics

Reasoning Is Not Free: Robust Adaptive Cost-Efficient Routing for LLM-as-a-Judge

تقدم هذه الورقة البحثية RACER، وهو إطار عمل توجيهي تكيفي قوي يختار ديناميكيًا بين أحكام النماذج اللغوية الكبيرة (LLMs) القائمة على الاستنتاج وغير القائمة عليه تحت ميزانية ثابتة من خلال حل مسألة تحسين متينة توزيعيًا، مما يحقق مقايضات فائقة بين الدقة والتكلفة مع مراعاة التحولات في التوزيع.

Wenbo Zhang, Lijinghua Zhang, Liner Xiang, Hengrui Cai2026-05-12