💬 NLP

SPG: Sandwiched Policy Gradient for Masked Diffusion Language Models

تقدم هذه الورقة البحثية "تدرج السياسة الساندويتشي" (Sandwiched Policy Gradient - SPG)، وهي طريقة جديدة للتعلم التعزيزي تستخدم كلاً من الحدود العليا والدنيا للاحتمالية اللوغاريتمية للتغلب على عدم قابلية الحساب في نماذج اللغة الانتشارية، متفوقة بشكل كبير على النماذج المرجعية الحالية في اختبارات الاستدلال الرياضي والمنطقي.

Chenyu Wang, Paria Rashidinejad, DiJia Su, Song Jiang, Sid Wang, Siyan Zhao, Cai Zhou, Shannon Zejiang Shen, Feiyu Chen (…)2026-04-16
💬 NLP

Language steering in latent space to mitigate unintended code-switching

تقترح هذه الورقة طريقة خفيفة الوزن عند وقت الاستدلال تسمى توجيه اللغة في الفضاء الكامن، والتي تستخدم اتجاهات لغوية مشتقة من تحليل المكونات الرئيسية (PCA) للحد بفعالية من التبديل اللغوي غير المقصود في النماذج اللغوية الكبيرة متعددة اللغات مع الحفاظ على الدلالات بعبء حوسبي ضئيل.

Andrey Goncharov, Nikolai Kondusov, Alexey Zaytsev2026-04-16
💬 NLP

Scaling Test-Time Compute to Achieve IOI Gold Medal with Open-Weight Models

تقدم هذه الورقة GenCluster، وهو إطار عمل قابل للتوسع للحوسبة أثناء وقت الاختبار يُمكّن النماذج ذات الأوزان المفتوحة من تحقيق أداء الميدالية الذهبية في الأولمبياد الدولي للمعلوماتية (IOI) لأول مرة، مما يقلص الفجوة بين الأنظمة الذكية المفتوحة والمملوكة من خلال استراتيجية قابلة لإعادة الإنتاج تعتمد على التوليد واسع النطاق، والتجميع السلوكي، والتقديم بنظام التدوير.

Mehrzad Samadi, Aleksander Ficek, Sean Narenthiran, Siddhartha Jain, Wasi Uddin Ahmad, Somshubra Majumdar, Vahid Noroozi (…)2026-04-16
💬 NLP

fMRI-LM: Towards a Universal Foundation Model for Language-Aligned fMRI Understanding

تقدم الورقة البحثية fMRI-LM، وهو نموذج تأسيسي عالمي يربط بين التصوير بالرنين المغناطيسي الوظيفي واللغة من خلال إطار عمل ثلاثي المراحل يتضمن الترميز العصبي، والتكيف المشترك مع النماذج اللغوية الكبيرة، والضبط الدقيق متعدد المهام لتمكين فهم دلالي قابل للتوسع ومتوافق لغوياً مع نشاط الدماغ.

Yuxiang Wei, Yanteng Zhang, Xi Xiao, Chengxuan Qian, Tianyang Wang, Vince D. Calhoun2026-04-16
💬 NLP

Reducing Hallucinations in LLMs via Factuality-Aware Preference Learning

تقدم هذه الورقة البحثية F-DPO، وهو امتداد بسيط لـ Direct Preference Optimization يستفيد من تسميات الحقيقة الثنائية لتصحيح ترتيب أزواج التفضيل وتطبيق هوامش مدركة للحقيقة، مما يقلل بفعالية من الهلوسة ويحسن الدقة الواقعية عبر مختلف النماذج اللغوية الكبيرة دون الحاجة إلى نماذج مكافأة مساعدة أو مسارات تدريب معقدة.

Sindhuja Chaduvula, Ahmed Y. Radwan, Azib Farooq, Yani Ioannou, Shaina Raza2026-04-16
💬 NLP

Exposía: Teaching and Assessment of Academic Writing Skills for Research Project Proposals and Peer Feedback

تقدم هذه الورقة Expos'ia، وهي أول مجموعة بيانات عامة تربط مقترحات الأبحاث الطلابية بملاحظات متعددة المراحل من الأقران والمدرسين، لتقييم نماذج اللغات الكبيرة في مهام التقييم الآلي وتحديد استراتيجيات التلقين الفعالة للتقييم التعليمي.

Dennis Zyska, Alla Rozovskaya, Ilia Kuznetsov, Iryna Gurevych2026-04-16
💬 NLP

TRIM: Hybrid Inference via Targeted Stepwise Routing in Multi-Step Reasoning Tasks

تقدم الورقة البحثية إطار عمل TRIM، وهو إطار استدلال هجين يحسن كفاءة التكلفة في مهام الاستدلال متعددة الخطوات من خلال استخدام نماذج مكافأة العمليات لتوجيه الخطوات الحرجة والمعرضة للخطأ فقط إلى النماذج الأكبر، بينما يسمح للنماذج الأصغر بالتعامل مع الخطوات الروتينية، مما يمنع الفشل المتتالي بتكاليف حوسبة أقل بك didik.

Vansh Kapoor, Aman Gupta, Hao Chen, Anurag Beniwal, Jing Huang, Aviral Kumar2026-04-16
💬 NLP

Common to Whom? Regional Cultural Commonsense and LLM Bias in India

تقدم هذه الورقة "إنديكا" (Indica)، وهو أول معيار يكشف أن البديهة الثقافية في الهند هي إقليمية في الغالب وليست وطنية، وتوضح أن النماذج اللغوية الكبيرة الحالية تعاني مع هذا التنوع بينما تظهر انحيازاً جغرافياً كبيراً تجاه وسط وشمال الهند.

Sangmitra Madhusudan, Trush Shashank More, Steph Buongiorno, Renata Dividino, Jad Kabbara, Ali Emami2026-04-16
💬 NLP

Sparse or Dense? A Mechanistic Estimation of Computation Density in Transformer-based LLMs

تقدم هذه الورقة مقدراً ميكانيكياً لقياس كثافة الحوسبة في النماذج اللغوية الكبيرة القائمة على بنية "ترانسفورمر"، كاشفةً أن المعالجة هي عموماً كثيفة وديناميكية، مع ارتباط مستويات الكثافة عبر النماذج واختلافها بناءً على ندرة الرمز وطول السياق.

Corentin Kervadec, Iuliia Lysova, Marco Baroni, Gemma Boleda2026-04-16
💻 computer science

A Domain-Specific Language for LLM-Driven Trigger Generation in Multimodal Data Collection

تقترح هذه الورقة إطار عمل تصريحيًا يستفيد من النماذج اللغوية الكبيرة لترجمة طلبات المستخدم باللغة الطبيعية إلى برامج لغة محددة النطاق وقابلة للتحقق، مما يتيح جمعًا فعالاً، وموجهاً بالنية، وانتقائياً لبيانات المستشعرات متعددة الوسائط على الأجهزة مع تقليل تكاليف التخزين وزمن تنفيذ الاستجابة مقارنة بالتسجيل السلبي.

Philipp Reis, Philipp Rigoll, Martin Zehetner, Jacqueline Henle, Stefan Otten, Eric Sax2026-04-16