💻 computer science

When Are Teacher Tokens Reliable? Position-Weighted On-Policy Self-Distillation for Reasoning

تقدم هذه الورقة طريقة التقطير الذاتي داخل السياسة الموزون بالموضع (PW-OPSD)، وهي طريقة تعمل على تحسين أداء نماذج الاستدلال من خلال تحديد أن موثوقية توكن المعلم تتبع نمطاً ذا بنية مسارية يمكن التنبؤ به بشكل أفضل عبر موضع التوكن بدلاً من الإنتروبيا، مما يسمح بالتقطير المستهدف دون حسابات إضافية للمعلم.

Xiaogeng Liu, Xinyan Wang, Yingzi Ma, Yechao Zhang, Chaowei Xiao2026-05-22
💻 computer science

AgForce Enables Antigen-conditioned Generative Antibody Design

تُعد AgForce بنية مشفر-فك تشفير (encoder-decoder) مبتكرة تتغلب على مشكلتي "العمى المستضدي" و"انهيار المفردات" في طرق تصميم الأجسام المضادة الحالية عبر توظيف مكونات متخصصة مثل إسقاط الإطار (framework dropout)، والوحدات العنقودية المبوّبة (gated bottlenecks)، وشبكة كثافة الخليط (Mixture Density Network) لتحقيق تصميم أجسام مضادة متفوق مشروط بالمستضد مع تحسين جودة الارتباط واستعادة التسلسل.

Mansoor Ahmed, Murray Patterson2026-05-22
💻 computer science

UniVL: Unified Vision-Language Embedding for Spatially Grounded Contextual Image Generation

يقدم UniVL إطار عمل موحداً لتمثيل الرؤية واللغة يلغي الحاجة إلى مشفرات نصية مستقلة عبر القراءة البصرية للتعليمات المُصوّرة مكانياً لتحقيق توليد صور سياقي عالي الجودة وفعال ومحدد مكانياً.

Jiayun Wang, Yu Wang, Weijie Gan, Zhenting Wang, Wei Wei2026-05-22
💻 computer science

ASSEMBLAGE-DEEPHISTORY: A Cross-Build Binary Dataset with Temporal Coverage

تقدم الورقة البحثية ASSEMBLAGE-DEEPHISTORY، وهي مجموعة بيانات ثنائية شاملة متعددة البناء تحتوي على 73,610 ملفاً ثنائياً من 248 مشروعاً مفتوح المصدر توحد سياق التجميع، والشيفرة المصدرية، وتسميات الثغرات الأمنية (CVE) عبر المترجمات، ومستويات التحسين، والزمن، مما يتيح تحليلات جديدة للكشف عن الثغرات الأمنية في الملفات الثنائية والتشابه بينها.

Chang Liu, Noah Fleischmann, Nicolò Altamura, Edward Raff, James Holt, Kristopher Micinski2026-05-22
🧬 biology

BlockFormer\textit{BlockFormer} : Transformer-based inference from interaction maps

تقدم هذه الورقة البحثية "BlockFormer"، وهو أسلوب قائم على المحولات (transformer) تم تدريبه على بيانات اصطناعية يستنتج بدقة المعلمات من خرائط التفاعل متغيرة الحجم، وهو ما تجلى في تطبيقه الناجح لتحديد موقع السنترومير عبر أنواع مختلفة.

Eloïse Touron, Pedro L. C. Rodrigues, Julyan Arbel, Nelle Varoquaux, Michael Arbel2026-05-22
💻 computer science

Alike Parts: A Feature-Informed Approach to Local and Global Prototype Explanations

تقدم هذه الورقة "الأجزاء المتشابهة" (Alike Parts)، وهو إطار عمل يعزز التفسيرات القائمة على النماذج الأولية باستخدام درجات أهمية الميزات لتسليط الضوء على الميزات ذات الصلة المشتركة من أجل التفسير المحلي، ولتعزيز تنوع الميزات في اختيار النماذج الأولية العالمية دون المساس بدقة التنبؤ.

Jacek Karolczak, Jerzy Stefanowski2026-05-22
📊 statistics

Dropout Universality: Scaling Laws and Optimal Scheduling at the Edge-of-Chaos

تؤسس هذه الورقة نظرية مجال متوسط لعملية الإسقاط (dropout) باعتبارها اضطراباً لانتشار الإشارة الحرج، كاشفةً عن فئات عالمية متميزة للتنشيطات الناعمة مقابل المنكسرة، ومستنتجةً جداول زمنية مثالية للإسقاط تعتمد على التقديم الأمامي، والتي تقلل بشكل كبير من خسارة الاختبار في الشبكات العصبية العميقة.

Lucas Fernandez Sarmiento2026-05-22
💬 NLP

EntmaxKV: Support-Aware Decoding for Entmax Attention

يُعد EntmaxKV إطار عمل لفك التشفير المتناثر المدرك للدعم، والذي يستفيد من التناثر الدقيق لانتباه α\alpha-entmax لتحميل صفحات ذاكرة التخزين المؤقت (KV cache) بشكل انتقائي قبل عملية الاستدلال، مما يقلل بشكل كبير من حركة مرور الذاكرة ويحقق تسارعاً جوهرياً في توليد السياقات الطويلة مع الحفاظ على دقة مقاربة للنماذج المرجعية ذات الذاكرة الكاملة.

Gonçalo Duarte, Miguel Couceiro, Marcos V. Treviso2026-05-22
💬 NLP

Amplifying, Not Learning: Fine-Tuned AI Text Detectors Amplify a Pretrained Direction

تجادل هذه الورقة بأن كواشف النصوص المعتمدة على الذكاء الاصطناعي تعمل أساساً على تضخيم محور "النمطية" (typicality) المُدرب مسبقاً والمتأصل في المشفرات الخام بدلاً من تعلم حد فاصل متميز بين الذكاء الاصطناعي والبشر، وهي آلية تفسر فشلها في التعامل مع كتابات غير الناطقين باللغة، وقابليتها للتأثر بالتدخلات البسيطة، وحقيقة أن المسابر (probes) الدنيا يمكنها مضاهاة أداء الضبط الدقيق الكامل.

Alexander Smirnov2026-05-22
💬 NLP

Value-Gradient Hypothesis of RL for LLMs

تقترح هذه الورقة فرضية تدرج القيمة لتفسير فعالية طرق التعلم المعزز الخالية من الناقد مثل PPO وGRPO في مرحلة ما بعد التدريب للنماذج اللغوية الكبيرة، حيث تُثبت أن تحديثات الممثل تقرب تدرجات القيمة من خلال التفاضل التلقائي وتضع معياراً لمتى يحقق التعلم المعزز أكبر المكاسب بناءً على إشارة القيمة وهامش المكافأة.

Arip Asadulaev, Daniil Ognev, Karim Salta, Martin Takac2026-05-22