💬 NLP

KAT-Coder-V2 Technical Report

يُعد KAT-Coder-V2 نموذجاً برمجياً وكيلياً طورته شركة Kuaishou، يعتمد على نموذج "التخصص ثم التوحيد" لتدريب خمسة مجالات خبيرة قبل دمجها في نموذج واحد، محققاً أداءً هو الأفضل في فئته على معايير مثل SWE-bench Verified وPinchBench من خلال ابتكارات مثل بنية KwaiEnv واستقرار MCLA.

Fengxiang Li, Han Zhang, Haoyang Huang, Jinghui Wang, Jinhua Hao, Kun Yuan, Mengtong Li, Minglei Zhang, Pengcheng Xu, We (…)2026-03-31
💬 NLP

Retromorphic Testing with Hierarchical Verification for Hallucination Detection in RAG

تقدم هذه الورقة RT4CHART، وهو إطار عمل للاختبار الرجعي (retromorphic) يستخدم التحقق الهرمي على مستوى الادعاء لتحقيق أفضل النتائج في الكشف عن الهلوسة دقيقة التفاصيل في أنظمة التوليد المعزز بالاسترجاع، بينما تكشف أيضاً أن المعايير المرجعية الحالية تقلل بشكل كبير من تقدير مدى انتشار الهلوسة.

Boxi Yu, Yuzhong Zhang, Liting Lin, Lionel Briand, Emir Muñoz2026-03-31
💬 NLP

TailNLG: A Multilingual Benchmark Addressing Verbalization of Long-Tail Entities

تقدم هذه الورقة TailNLG، وهو معيار جديد متعدد اللغات يكشف عن انحياز أداء مستمر في النماذج اللغوية الكبيرة ضد كيانات الذيل الطويل أثناء توليد النصوص من البيانات، مما يسلط الضف على الحاجة إلى أطر تقييم أكثر موثوقية لمعالجة هذه الفجوة.

Lia Draetta, Michael Oliverio, Virginia Ramón-Ferrer, Pier Felice Balestrucci, Flaviana Corallo, Carlos Badenes-Olmedo (…)2026-03-31
💬 NLP

Conversational Agents and the Understanding of Human Language: Reflections on AI, LLMs, and Cognitive Science

تستعرض هذه الورقة تطور نماذج معالجة اللغات الطبيعية وعلاقتها بنظريات القدرة اللغوية البشرية، وتخلص إلى أنه على الرغم من القدرات المثيرة للإعجاب لنماذج اللغات الكبيرة الحديثة، فإن تطويرها لم يساهم بشكل كبير في تعزيز فهمنا لكيفية معالجة العقل البشري للغة الطبيعية.

Andrei Popescu-Belis2026-03-31
🤖 machine learning

KVSculpt: KV Cache Compression as Distillation

يقدم KVSculpt طريقة مبتكرة لضغط ذاكرة التخزين المؤقت لـ KV تعمل على تحسين أزواج KV غير المقيدة في فضاء التضمين المستمر عبر الحلول المتبادلة لـ L-BFGS والمربعات الصغرى، المعززة بتخصيص ميزانية تكيفي، لتقليل تباعد KL بشكل كبير والحفاظ على سلوك الانتباه مقارنة بنهج الاختيار أو الدمج الحالية.

Bo Jiang, Sian Jin2026-03-31
💬 NLP

Improving Clinical Diagnosis with Counterfactual Multi-Agent Reasoning

تقترح هذه الورقة إطار عمل متعدد الوكلاء قائم على التفكير المقابل (counterfactual) يعزز التشخيص السريري من خلال اختبار الفرضيات صراحةً عبر تعديل الأدلة وقياس تحولات الثقة، مما يؤدي إلى تحسين دقة التشخيص وقابلية تفسير الاستدلال عبر مختلف المعايلات والنماذج اللغوية الكبيرة.

Zhiwen You, Xi Chen, Aniket Vashishtha, Simo Du, Gabriel Erion-Barner, Hongyuan Mei, Hao Peng, Yue Guo2026-03-31
💬 NLP

Model Capability Dominates: Inference-Time Optimization Lessons from AIMO 3

في مسابقة AIMO 3، أظهرت التجارب أن قدرة النموذج تهيمن بشكل ساحق على استراتيجيات التحسين أثناء الاستنتاج، حيث إن محاولات تحسين الأداء من خلال التلقين المتنوع أو إلغاء ارتباط الأخطاء قد تفوقت عليها باستمرار ببساطة عملية استخدام نموذج أكثر قدرة.

Natapong Nitarach2026-03-31
💬 NLP

KazByte: Adapting Qwen models to Kazakh via Byte-level Adapter

تقترح KazByte طريقة تكيف ثنائية المراحل لنموذج Qwen2.5-7B تتجاوز أجهزة الترميز (tokenizers) باستخدام محول على مستوى البايت للربط مع النصوص الكازاخية الخام، بهدف التغلب على عدم كفاءة الترميز وتحسين الأداء في اختبارات القياس الخاصة باللغة الكازاخية.

Rauan Akylzhanov2026-03-31
💬 NLP

HumMusQA: A Human-written Music Understanding QA Benchmark Dataset

تقدم هذه الورقة البحثية HumMusQA، وهي مجموعة بيانات مرجعية منسقة بدقة تضم 320 سؤالاً مكتوباً بواسطة بشر، صُممت لتقييم قدرات فهم الموسيقى لدى النماذج اللغوية الصوتية الكبيرة، مما يثبت من خلال تجارب على ستة نماذج رائدة أن التنسيق اليدوي من قبل خبراء الموسيقى أمر ضروري لسبر أغوار الفهم الصوتي المعقد وتجنب الاختصارات أحادية النمط.

Benno Weck, Pablo Puentes, Andrea Poltronieri, Satyajeet Prabhu, Dmitry Bogdanov2026-03-31
💬 NLP

EnsemJudge: Enhancing Reliability in Chinese LLM-Generated Text Detection through Diverse Model Ensembles

تقدم الورقة البحثية EnsemJudge، وهو إطار عمل قوي يستخدم مجموعات نماذج متنوعة واستراتيجيات مخصصة حقق المركز الأول في المهمة المشتركة NLPCC2025 من خلال التفوق على جميع النماذج المرجعية في كشف النصوص المولدة بواسطة النماذج اللغوية الكبيرة الصينية.

Zhuoshang Wang, Yubing Ren, Guoyu Zhao, Xiaowei Zhu, Hao Li, Yanan Cao2026-03-31