🤖 machine learning

When Should Graph Attention Be Sparse? Learning a Per-Edge Tsallis Index

تقترح الورقة البحثية آلية LTGA، وهي آلية انتباه رسومي تتعلم مؤشر "تساليس" (Tsallis) لكل حافة للقيام بالاستيفاء الديناميكي بين أشكال الانتباه الكثيفة والمتفرقة، مما يثبت أنه بينما لا تتفوق المؤشرات المتعلمة على المعلمات الثابتة المضبوطة بعناية في الدقة الإجمالية، إلا أنها تحدد بفعالية الحواف الضارة وتقصها لتحسين قابلية التفسير والكفاءة في النموذج.

Kleyton da Costa, Bernardo Modenesi2026-08-05
💻 computer science

When Compression Scores Cannot Decide: Information Boundaries for Group-Robust LLM Pruning

تجادل هذه الورقة بأن درجات الضغط القياسية غالباً ما تخفق في تحديد مرشحي التقليم الأمثل من أجل المتانة الجماعية بسبب عدم حل حدود المعلومات، وتقترح بدلاً من ذلك إطاراً يستخدم العزوم المحلولة جماعياً وضمانات اختيار موثقة لتقليل إدراك النص (perplexity) للمجموعة الأسوأ بشكل كبير في النماذج اللغوية الكبيرة.

Andrew Zhang2026-08-05
🤖 machine learning

Rubrics as Privileged Information for Open-Ended Generation

تقدم هذه الورقة طريقة للتوليد مفتوح النهايات تعامل المعايير (rubrics) كمعلومات متميزة كثيفة لعملية التقطير الذاتي في الوقت الفعلي (on-policy self-distillation)، مما يثبت أن هذا النهج يتفوق على كل من تقطير إكمال المرجع (reference-completion distillation) والتعلم التعزيزي باستخدام المعيار كمكافأة (reinforcement learning with rubric-as-reward) من خلال توفير إشارات تدريب أغنى وأقل تقييداً عبر عائلات نماذج ومعايير اختبار متعددة.

Deepika Bablani, Ajay Gupta, Wanming Chen2026-08-05
💻 computer science

On the missing data layer and a potential solution

تحدد هذه الورقة النقص الحرج في طبقة بيانات موحدة في البنية التحتية للذكاء الاصطنا الاصطناعي في أمريكا اللاتينية، والذي يتسم بقضايا الاكتشاف وعدم كفاية العرض، وتقترح "DataHub"، وهي بنية تحتية للبيانات قائمة على المهام ومبنية على أنطولوجيا محددة لتمكين اكتشاف مجموعات البيانات، وإدارة البيانات الوصفية، والمساهمة، والترخيص، وإعادة الاستخدام.

Francis F Daniel, Mauro Ibañez, Francis Perelman, Marian Basti2026-08-05
💻 computer science

ValueFormer: A Causal Transformer Value Function with Stage-Aware Labels for Semi-Autonomous Vision-Language-Action Policies

يعالج ValueFormer الفشل الصامت لسياسات الرؤية واللغة والعمل القائمة على التعلم بالتقليد من خلال تقديم محول سببي مدمج يولد تسميات قيمة كثيفة ومدركة للمراحل لكل إطار لتمكين الكشف الفعال عن الأخطاء عبر الإنترنت وتقدير الميزة، مما يحسن بشكل كبير معدلات إكمال المهام في مهام التلاعب بالروبوتات الحقيقية دون الحاجة إلى تعلم تعزيزي مكلف.

Inkyu Sa, Konstantin Stulov, Rajat Bhageria2026-08-05
🧬 biology

Scaling an Autoregressive Transformer for Single-Cell Generation

تقدم هذه الورقة نموذج محول ذاتي الإشراف ذاتي تراجعي مع مشفر تلقائي (VAE) مكمّم لتوليد نواقل تعبير جيني أحادية الخلية دقيقة بيولوجياً، مما يؤسس لأول قانون قياس مشترك ذي أسّين وحد لـ "الحد الأمثل للحوسبة" لنموذج تأسيسي أحادي الخلية، مع إثبات قدرته على التنبؤ بالاستجابة للاضطرابات.

Aleksandr Sharipov, Yusif Mukhtarov, Igor Molybog2026-08-05
💬 NLP

TQLite: Multi-LLM Jury Guided Distillation for Real-time MQM Translation Quality Evaluation

تقدم هذه الورقة TQLite، وهو إطار عمل تقطير مبتكر يستفيد من هيئة تحكيم متعددة النماذج اللغوية الكبيرة لتوليد بيانات تدريب اصطناعية عالية الجودة، مما يمكّن النماذج اللغوية الصغيرة من تحقيق أداء في تقييم جودة الترجمة يتسم بالسرعة والقابلية للتوسع ويضاهي النماذج اللغوية الكبيرة المكلفة حوسبياً.

Bhavin Jawade, Cameron R. Wolfe2026-08-05
💻 computer science

Internalising the Identity Primitive: Cryptographic Individuality for an Autonomous Agent on a Public Blockchain

تقدم هذه الورقة وتثبت تجريبياً إطاراً تشفيرياً جديداً للوكلاء المستقلين في البلوكشين، يعمل على ترسيخ الفردية من خلال ربط أوزان الشبكة العصبية بمفتاح خاص عبر براهين المعرفة الصفرية، مما يضمن ثبات الهوية والجدوى الاقتصادية عبر تكالين استقلابية على شبكة سولانا التجريبية (Solana devnet).

Keisuke Suzuki2026-08-05
💻 computer science

Neurosymbolic Reasoning with Incremental Knowledge for Sample Efficient Hierarchical Reinforcement Learning

تقترح هذه الورقة إطار عمل للتعلم التعزيزي الهرمي العصبي الرمزي يدمج المعرفة التزايدية (InK) والبحث في شجرة عالم الاعتقاد لتمكين التخطيط الرمزي القابل للتحديث والتعلم العصبي المشكل بالمكافأة، مما يؤدي إلى تحسين كفاءة العينة بشكل كبير في مهام الملاحة ذات الأفق الطويل والمكافآت الشحيحة.

Subrat Prasad Panda, Blaise Genest, Arvind Easwaran2026-08-05
💻 computer science

On the missing benchmarks layer and a potential solution

تحدد هذه الورقة غياب طبقة مرجعية إقليمية كعائق حاسم أمام تطوير الذكاء الاصطناعي المحلي في أمريكا اللاتينية، وتقترح "EvalsHub" (بنموذجه الأولي LatamBoard) كبنية تحتية مفتوحة ومدفوعة بالحوافز لتمكين التدقيق المستقل وتحسين أنظمة الذكاء الاصطناعي وفقاً للمتطلبات الاجتماعية والاقتصادية المحلية.

Francis F Daniel, Mauro Ibañez, Francis Perelman, Marian Basti2026-08-05