💬 NLP

SOLAR: Communication-Efficient Model Adaptation via Subspace-Oriented Latent Adapter Reparametrization

تقدم الورقة البحثية SOLAR، وهو إطار عمل لضغط ما بعد التدريب غير مرتبط بنموذج محدد يستفيد من المتجهات الفردية للنموذج التأسيسي لإعادة تمثيل محولات الضبط الدقيق الفعالة للمعلمات (PEFT) في تمثيلات مدمجة وفعالة من حيث الاتصال، مما يقلل بشكل كبير من تكاليف التخزين والنقل مع الحفاظ على أداء المهام عبر المهام اللغوية والبصرية.

Seyed Mahmoud Sajjadi Mohammadabadi, Xiaolong Ma, Lei Yang, Feng Yan, Junshan Zhang2026-04-10
💬 NLP

Don't Overthink It: Inter-Rollout Action Agreement as a Free Adaptive-Compute Signal for LLM Agents

تقدم الورقة البحثية TrACE، وهو متحكم لا يتطلب تدريباً يقوم بتخصيص حوسبة وقت الاستدلال ديناميكياً لوكلاء النماذج اللغوية الكبيرة من خلال قياس مدى الاتفاق بين الإجراءات في عمليات المحاكلة، مما يحقق دقة تضاهي طرق الاتساق الذاتي ذات الميزانية الثابتة مع تقليل عدد استدعاءات النماذج اللغوية الكبيرة بشكل كبير في كل من مهام الاستدلال والملاحة.

Khushal Sethi2026-04-10
📊 statistics

Synthetic Data for any Differentiable Target

تقدم هذه الورقة "تدرج سياسة مجموعة البيانات" (DPG)، وهي طريقة للتعلم المعزز تعمل على تحسين مولدات البيانات الاصطناعية باستخدام عزو البيانات الدقيق للتحكم بدقة في خصائص نماذج اللغة المستهدفة وتشكيلها عبر الضبط الدقيق الخاضع للإشراف، حتى بالنسبة للأهداف غير الموجودة صراحةً في مطالبات المولد.

Tristan Thrush, Sung Min Park, Herman Brunborg, Luke Bailey, Marcel Roed, Neil Band, Christopher Potts, Tatsunori Hashim (…)2026-04-10
💬 NLP

KV Cache Offloading for Context-Intensive Tasks

تكشف هذه الورقة أن طرق تفريغ ذاكرة التخزين المؤقت لـ KV (KV-cache offloading) الحالية تضعف الأداء بشكل كبير في المهام كثيفة السياق مثل معيار Text2JSON المستحدث حديثاً بسبب الإسقاط منخفض الرتبة والمعالم غير الموثوقة، وتقترح استراتيجية بديلة أبسط تحسن الدقة بشكل كبير عبر عائلات متعددة من النماذج اللغوية الكبيرة.

Andrey Bocharnikov, Ivan Ermakov, Denis Kuznedelev, Vyacheslav Zhdanovskiy, Yegor Yershov2026-04-10
💬 NLP

AfriVoices-KE: A Multilingual Speech Dataset for Kenyan Languages

تُعد AfriVoices-KE مجموعة بيانات صوتية متعددة اللغات، ضخمة وعالية الجودة، تضم حوالي 3,000 ساعة من التسجيلات النصية والعفوية من ما يقرب من 5,000 متحدث أصلي عبر خمس لغات كينية، وهي مصممة لمعالة نقص التمثيل للغات الأفريقية في تكنولوجيا الكلام ودعم تطوير أنظمة التعرف التلقائي على الكلام وتوليد الكلام من نص شاملة.

Lilian Wanzare, Cynthia Amol, zekiel Maina, Nelson Odhiambo, Hope Kerubo, Leila Misula, Vivian Oloo, Rennish Mboya, Edwi (…)2026-04-10
💬 NLP

Entropy-Gradient Grounding: Training-Free Evidence Retrieval in Vision-Language Models

تقدم هذه الورقة البحثية "تأريض تدرج الإنتروبيا" (Entropy-Gradient Grounding)، وهي طريقة لا تتطلب تدريباً تعزز قدرة نماذج الرؤية واللغة على استرجاع الأدلة للاستعلامات المعقدة عبر نشر إنتروبيا الرمز التالي عكسياً لتوليد خرائط صلة، مما يتيح صقلاً بصرياً تكرارياً مدفوعاً بعدم اليقين دون الحاجة إلى كواشف مساعدة.

Marcel Gröpl, Jaewoo Jung, Seungryong Kim, Marc Pollefeys, Sunghwan Hong2026-04-10
💬 NLP

Formalizing building-up constructions of self-dual codes through isotropic lines in Lean

تثبت هذه الورقة التكافؤ بين إنشاءات كيم (Kim) وتشينبورغ-تشانغ (Chinburg-Zhang) للأكواد ذاتية الثنائية الثنائية، وتوسع الأخيرة لتشمل الحقول الـ qq-ary حيث q1(mod4)q \equiv 1 \pmod{4} من خلال الاستفادة من الشرط بأن $-1$ هو مربع لتوحيد المنظورين الجبري والهندسي، وتقدم صياغة رسمية بلغة Lean 4 لهذه النتائج لإنشاء مختلف الأكواد ذاتية الثنائية المثالية وأكواد MDS بكفاءة.

Jae-Hyun Baek, Jon-Lark Kim2026-04-10
💬 NLP

PIArena: A Platform for Prompt Injection Evaluation

لمعالجة غياب إطار تقييم موحد لهجمات حقن الأوامر (prompt injection)، قدم المؤلفون PIArena، وهي منصة قابلة للتوسع تسهل دمج الهجمات والدفاعات المتنوعة، مما كشف عن قيود حرجة في الدفاعات الحالية المتطورة مثل ضعف القدرة على التعميم والهشاشة أمام الاستراتيجيات التكيفية.

Runpeng Geng, Chenlong Yin, Yanting Wang, Ying Chen, Jinyuan Jia2026-04-10
💬 NLP

sciwrite-lint: Verification Infrastructure for the Age of Science Vibe-Writing

تقدم الورقة البحثية sciwrite-lint، وهي أداة تحقق محلية مفتوحة المصدر تستخدم الذكاء الاصطناعي للتحقق تلقائياً من المخطوطات العلمية عبر فحص سلامة المراجع ودعم الاستشهادات، بينما تقترح أيضاً "درجة SciLint" تجريبية للتقييم الحسابي لمدى الرصانة الفلسفية للحجج العلمية.

Sergey V Samsonau2026-04-10
💬 NLP

What Drives Representation Steering? A Mechanistic Case Study on Steering Refusal

تتقصى هذه الورقة الآليات السببية لمتجهات التوجيه في النماذج اللغوية الكبيرة من خلال دراسة حالة حول الرفض، كاشفةً أنها تعمل أساساً عبر التفاعل مع دائرة (OV) لتعديل درجات الانتباه، مما يسمح بتجزئة كبيرة وتحديد مفاهيم قابلة للتفسير دلالياً.

Stephen Cheng, Sarah Wiegreffe, Dinesh Manocha2026-04-10