💬 NLP

Repair, Not Improvement: Decomposing Constrained Decoding in Tool-Call Abstention

تُثبت هذه الورقة أن فك التشفير المقيد في سيناريوهات استدعاء الأدوات غالباً ما يفشل في إصلاح أخطاء الامتناع، لأن التأثير السلبي لفرض رموز التوقف غالباً ما يفوق فوائد تقييد خيارات الرموز، مما يكشف في النهاية أن الادعاءات السابقة حول اختلافات الأداء الخاصة باللغات غير مدعومة.

Janghoon Lee (Redrob)2026-08-17
💬 NLP

Batch-wise Adaptive Pruning: Periodic Neuron Activation-Aware Weight Pruning for Language Reasoning Model

تقترح هذه الورقة طريقة تقليم تكيفية على مستوى الدفعات وخالية من التدريب لنماذج الاستدلال الكبيرة، تستخدم اختيار (top-k) الدوري وآلية ذاكرة التنشيط للتغلب على تدهور الدقة في الطرق الحالية أثناء الاستدلال بالدفعات، مما يحقق تسريعاً كبيراً مع الحفاظ على أداء استدلال عالٍ.

Yongmin Kim, Shota Takashiro, Yusuke Iwasawa, Takeshi Kojima, Yutaka Matsuo2026-08-17
💬 NLP

S2Dialog: Multimodal Dialogue Retrieval with Semantic and Acoustic-Style Modeling

تقترح الورقة البحثية S2Dialog، وهو إطار عمل موحد يقوم بعملية استرجاع متعدد الوسائط على مستوى الحوار من خلال النمذجة المشتركة للدلالات النصية والأساليب الصوتية عبر مسترجعات مخصصة والتعلم التبايني، متجاوزاً بذلك قيود الطرق الحالية التي تعتمد على مستوى العبارة أو أحادية الوسائط.

Xueqi Wang, Zhigang Wang, Runqing Zhang, Zhenqi Jia, Junfeng Zhao2026-08-17
💬 NLP

HERMES: a multi-agent framework for structured knowledge extraction from ultra-long documents in geoscience

يُعد HERMES إطار عمل متعدد الوكلاء وقابل للتوسع يستفيد من نموذج لغوي كبير منسق لاستخراج معرفة مهيكلة وموجهة نحو معايير FAIR من وثائق علوم الأرض فائقة الطول وغير المنظمة، حيث نجح في تحويل "رسالة علم الحفريات اللافقارية" المكونة من 55 مجلداً إلى قاعدة بيانات شاملة بدقة عالية وتحقيق مكاسب في الكفاءة بمقدار ستة أضعاف مقارنة بالطرق اليدوية.

Ziqi Song, Zongyuan Xiang, James G. Ogg, Bruce S. Lieberman, Gabi Ogg, Natalia López Carranza, Wen Du, Yufei Ye, Shuan L (…)2026-08-17
🔬 materials science

The conditional superiority of fast silicon sampling

تخلص هذه الدراسة إلى أنه بينما تظل عملية أخذ عينات السيليكونون باستخدام النماذج الرائدة طريقة في مراحلها المبكرة تقلل من تقدير تباين الآراء وتُشوه الفضاء السياقي، فإن وضعها "السريع" يقدم تفوقاً مشروطاً على الأوضاع "البطيئة" من خلال تقديم دقة خوارزمية أعلى بكفاءة أكبر بكثير في موارد الحوسبة ووقت التشغيل.

Nickolas Hock Yuen Lam, Ji Xuan Voo, Xiangyu Ma2026-08-17
⚡ electrical engineering

KV Cache Compression Through the Lens of Transform Coding

تقدم هذه الورقة البحثية ترميز التحويل الواعي بالانتباه (AATC)، وهو طريقة مبتكرة لضغط ذاكرة التخزين المؤقت لـ KV تستفيد من مبادئ معالجة الإشارات لتخصيص البتات بناءً على تأثيرها على آليات الانتباه، محققةً دقة تقارب عدم الفقد عند ضغط يصل إلى 5.8 ضعفاً عبر معايير ونماذج متعددة.

Hannah Laus, Claudio Mayrink Verdun, Hao Wang, Flavio du Pin Calmon, Felix Krahmer2026-08-17
🤖 AI

MathForm: Scaling Mathematical Autoformalization with Knowledge Retrieval and Verification-Guided Refinement

تقدم الورقة البحثية MathForm، وهو إطار عمل يستفيد من استرجاع معرفة Mathlib والتحسين التكراري الموجه بالتحقق لبناء مجموعة بيانات FormalVerse واسعة النطاق، مما يمكّن تدريب نموذج MathForm-8B، الذي يتفوق بشكل كبير على نماذج الصياغة الآلية المتخصصة الحالية عبر معايير متعددة.

Lushi Pu, Weiming Zhang, Xinheng Xie, Zixuan Fu, Bingxiang He, Hengyu Zhao, Hongya Lyu, Xin Li, Jie Zhou, Yudong Wang2026-08-17
🤖 AI

Grounding Without Corrective Control: Truth-Tracking Profiles for Large Language Models

تقترح هذه الورقة إطاراً لتحليل قدرات تتبع الحقيقة لدى النماذج اللغوية الكبيرة من خلال التمييز بين "القابلية للإجابة الاشتقاقية" (الموروثة من أنماط التدريب) و"القابلية للإجابة الحية" (المعتمدة على مسارات تصحيح مستقلة وفورية)، مع المحاجة بأنه في حين تفتقر النماذج التي تعتمد على النصوص فقط إلى الأخيرة، فإن تدخلات محددة مثل الاسترجاع واستخدام الأدوات يمكن أن تستعيد التأصيل بشكل انتقائي دون اشتراط السيطرة التصحيحية الكاملة.

Brett Reynolds2026-08-17
💬 NLP

SimpleOPD: Simple Tokenizer-Agnostic On-Policy Distillation for Long-Context Reasoning

تقدم الورقة البحثية SimpleOPD، وهو إطار عمل للتقطير في السياسة (on-policy distillation) غير مرتبط بنوع الـ tokenizer، يعمل على محاذاة الامتدادات النصية المشتركة ويستخدم فقدان KL مرجعي للطالب لتقطير قدرات الاستدلال البرهاني ذات السياق الطويل بفعالية من المعلمين الأقوياء إلى الطلاب ذوي السياق القصير، مما يحقق مكاسب أداء كبيرة في الاختبارات المرجعية الرياضية والعلمية.

Haonan He, Haodi Lei, Yun Luo, Haoran Zhang, Shunkai Zhang, Yizhuo Li, Shengji Tang, Zhilin Wang, Runzhe Zhan, Lei Bai (…)2026-08-17
💬 NLP

Envs-FORGE: Frontier-Optimized Reward-Grounded Environment Synthesis for Agent RL

تُعد Envs-FORGE سياسة توجيه (prompting) مبتكرة تعمل على تحسين تخليق البيئات ديناميكيًا لتعلم التعزيز عبر تحويل مكافآت التحقق إلى إجراءات لكل بذرة (per-seed actions) بواسطة البرمجة الخطية للأعداد الصحيحة المختلطة، مما يؤدي إلى توليد بيئات تدريب مخصصة تُحسن أداء الوكيل بشكل كبير عبر مختلف المعايير المرجعية مقارنة بالنماذج المرجعية ذات الوصفات الثابتة.

Xiaojun Wu, Cehao Yang, Honghao Liu, Xueyuan Lin, Zhichao Shi, Hao Zhou, Xuhui Jiang, Chengjin Xu, Jia Li, Jian Guo2026-08-17