🤖 AI

Step-Level On-Policy Distillation: Interpolating Between On-Policy Distillation and Supervised Fine-Tuning

تقترح الورقة البحثية تقنية التقطير في الموقع على مستوى الخطوة (SOPD)، وهي طريقة مبتكرة تدمج بين الضبط الدقيق الخاضع للإشراف والتقطير في الموقع لتوفير تصحيحات كاملة على مستوى الخطوة للمسارات التي يولدها الطالب، مما يؤدي إلى تفوقها بشكل كبير على كلا النهجين التقليديين في مهام الاستنتاج والوكلاء.

Changhui Sun, Lanbo Liu, Hang Lei, Tong Ling, Jiahang Xie, Zhiyong Zheng, Yujia Wang, Hao Liu, Feng Xiao, Lu Liu, Yanlon (…)2026-08-18
💻 computer science

IndicQE-APE: A Benchmark for Quality Estimation and Automatic Post-Editing for Indic Languages

تقدم هذه الورقة البحثية IndicQE-APE، وهو معيار مرجعي موحد يجمع ١٢٦,٧٥٤ حالة عبر تسعة أزواج من اللغات الهندية مع تعليقات توضيحية متعددة الأوجه لتقييم ومقارنة أداء النماذج اللغوية الكبيرة (LLMs) ومقاييس COMET في مهام تقدير الجودة والتحرير اللاحق التلقائي.

Diptesh Kanojia, Archchana Sindhujan, Sourabh Deoghare, Daria Sokova, Shenbin Qian, Girish Koushik, Tharindu Ranasinghe (…)2026-08-18
🤖 machine learning

Architecture-Dependent Causal Transfer of Activation States Across Large Language Models

تُثبت هذه الورقة أنه بينما يمكن إسقاط حالات التنشيط الداخلية بين بنيات النماذج اللغوية الكبيرة المختلفة مع وجود محاذاة تمثيلية قابلة للقياس، فإن النقل السببي الناجح من البداية إلى النهاية لهذه الحالات أثناء عملية التوليد يعتمد بشكل صارم على البنية، حيث يعمل بشكل موثوق فقط لأزواج محددة من نماذج فك التشفير فقط (decoder-only) بدلاً من كونه آلية عالمية.

Fernando Cardenas Piepereit2026-08-18
🤖 AI

HalluTracer: Hallucination Detection via Depth-Averaging Truth Signals

يعتبر HalluTracer إطار عمل للكشف عن الهلوسة بنظام الصندوق الأبيض، وهو يعمل على تحسين الدقة من خلال تجميع إشارات الصدق عبر جميع طبقات المحولات (transformer layers) عبر عملية متوسط عمق بسيطة، مما يتغلب بذلك على فقدان المعلومات في الأساليب الحالية التي تعتمد على طبقات أو مكونات معزولة.

Zhihao Guo, Zonghan Wu, Huan Huo, DaYong Ye, Junwei Zhang, Weiran Yao, Zhiwei Liu, Qingsong Wen, Yilei Shao2026-08-18
💻 computer science

Unadapted Multilingual ASR on a Garrusi Kurdish Evaluation Set: A Common-Reference Staged Normalization Analysis

تقيم هذه الورقة نماذج التعرف التلقائي على الكلام متعددة اللغات غير المتكيفة على مجموعة بيانات لغة الكردي (الجاروسي) من خلال توظيف إطار عمل تطبيع مرحلي ذي مرجع مشترك لإثبات أن عدم التطابق الإملائي بين المراجع المنقولة إلى اللاتينية والفرضيات المكتوبة بالخط العربي يؤدي بشكل كبير إلى تضخيم معدلات الخطأ، مع الكشف أيضاً عن أن قيود خطوط المعالجة ونقاط الضعف الخاصة بكل نموذج تساهم في حدوث أخطاء متبقية جوهرية.

Hiwa Asadpour2026-08-18
🤖 machine learning

Mint-Agent: Introducing Finance-Native Agentic Foundation Models

تقدم الورقة البحثية Mint-Agent، وهي عائلة من النماذج التأسيسية الوكيلية المتخصصة في التمويل والمبنية على محرك بيانات متخصص، وحزام تفاعلي، ومسار تدريب متقدم يحقق مستويات رائدة في الموثوقية والقابلية للتنفيذ في المهام المالية المعقدة والقابلة للتدقيق.

Agent Team, B. Zhang, Yaze Geng, Lei Tang, Yaoyang Yi, Zonghan Wu, Yifan Hu, Kun Wang, Qingsong Wen, Yilei Shao2026-08-18
🤖 AI

Counting Documents Is Not Counting Text: Unit Bias in Web-PDF Corpus Statistics

تكشف هذه الورقة أن إحصائيات مجموعة بيانات الويب بصيغة PDF تعاني من "تحيز وحدة" كبير عبر الإبلاغ عن المقاييس لكل مستند بدلاً من كل رمز (token)، مما يحجب حقيقة أن جزءاً صغيراً من المستندات الكبيرة يحتوي على غالبية النص، وأن سياسات الاقتطاع الحالية تؤدي إلى فقدان أكثر من نصف المحتوى الإجمالي للمجموعة.

Luca Foppiano2026-08-18
🤖 AI

When Context Misleads: Intent-Guided Decoding for Robust Retrieval-Augmented Generation

تقترح الورقة البحثية إطار عمل "فك التشفير الموجه بالنية" (IGD)، الذي يعمل على التحكيم ديناميكيًا بين السياق المسترجع والذاكرة البارامترية بناءً على نية المستخدم لتحسين الاسترداد الواقعي بشكل كبير في توليد النصوص المعزز بالاسترجاع مع الحفاظ على سلوك صارم في اتباع السياق.

Haolin Jin, Pengyue Yang, Huaming Chen2026-08-18
🤖 AI

Listen, Reason, and Segment: Aligning LALMs with Editorial Judgment for Media Chapterization

تقدم هذه الورقة AudioChaps، وهو إطار عمل لما بعد التدريب يعمل على مواءمة نماذج اللغة الصوتية الكبيرة مع التقدير التحريري لتقسيم الوسائط إلى فصول بشكل آلي باستخدام تحسين السياسة النسبية للمجموعات والاستنتاج عبر سلسلة الأفكار، محققاً مكاسب كبيرة في الأداء مقارنة بالنماذج الرائدة دون الحاجة إلى مرحلة البداية الباردة للضبط الدقيق الخاضع للإشراف.

Tony Alex, Wish Suharitdamrong, Sara Atito, Armin Mustafa, Muhammad Awais, Philip J. B. Jackson, Jiankang Deng, Ismail E (…)2026-08-18
💻 computer science

STAGE: Controlled Objective Admission for Multi-Preference LLM Alignment

تقدم الورقة البحثية STAGE، وهو متحكم مجموعة نشطة موجه بالاستقرار يدير ديناميكياً توقيت ووزن قبول أهداف التفضيلات المتعددة أثناء محاذاة النماذج اللغوية الكبيرة، مما يظهر أداءً فائقاً على طرق التدرج الساكن من خلال الاحتفاظ بالأهداف بناءً على بوابات انحراف المكافأة والاستقصاء التكيفي.

Yongqi Tong, Zhenyu Zhang, Ruirui Wang, Kewei Fu, Shaoqing Lin, Sijie Dong, Jiang-Ming Yang, Xin Zhang, Jianshe Li2026-08-18