💬 NLP

Trajectory as the Teacher: Few-Step Discrete Flow Matching via Energy-Navigated Distillation

تقدم هذه الورقة البحثية طريقة "مطابقة التدفق المنفصل الموجه بالمسار" (TS-DFM)، وهي طريقة تقطير تستبدل القفزات العشوائية العمياء في مسارات النموذج المعلم بالملاحة الموجهة بالطاقة أثناء التدريب، مما يمكّن نموذج الطالب ذو الخطوات القليلة من تحقيق حيرة (perplexity) أقل بكثير وسرعة استدلال أكبر من النماذج المعلمة متعددة الخطوات والنماذج المرجعية الأكبر حجماً.

Amin Karimi Monsefi, Dominic Culver, Nikhil Bhendawade, Manuel R. Ciosici, Yizhe Zhang, Irina Belousova2026-05-11
💬 NLP

How to Train Your Latent Diffusion Language Model Jointly With the Latent Space

تقدم هذه الورقة نموذج لغة الانتشار الكامن (LDLM)، الذي يدرب بشكل مشترك مشفرًا كامنًا، ونموذج انتشار، وفك تشفير لإنشاء فضاء كامن مستمر عالي الجودة، محققًا أداءً فائقًا في توليد النصوص وسرعات استدلال أسرع بكثير مقارنة بنماذج الانتشار المنفصلة والمستمرة الحالية.

Viacheslav Meshchaninov, Alexander Shabalin, Egor Chimbulatov, Nikita Gushchin, Ilya Koziev, Alexander Korotin, Dmitry V (…)2026-05-11
💬 NLP

Ask Early, Ask Late, Ask Right: When Does Clarification Timing Matter for Long-Horizon Agents?

تقدم هذه الورقة إطار عمل للحقن القسري لإثبات أن التوقيت الأمثل لاستيضاح الوكيل الذكي يعتمد على المهمة، وتحديداً أن استيضاح الهدف يجب أن يحدث خلال أول 10% من التنفيذ بينما يظل استيضاح المدخلات ذا قيمة حتى 50%، مما يكشف عن فشل النماذج الرائدة الحالية في السؤال عند هذه النوافذ الحرجة المحددة تجريبياً.

Anmol Gulati, Hariom Gupta, Elias Lumer, Sahil Sen, Vamse Kumar Subbiah2026-05-11
💬 NLP

GLiGuard: Schema-Conditioned Classification for LLM Safeguard

يُعد GLiGuard مشفرًا ثنائي الاتجاه مدمجًا بـ 0.3 مليار معلمة ومشروطًا بالمخطط، ويحقق دقة تنافسية في تصنيف السلامة مع زمن انتقال أقل بكثير وإنتاجية أعلى من نماذج الحماية التوليدية الكبيرة عبر ترميز تعريفات المهام ودلالات التسميات مباشرة في المدخلات للتقييم المتزامن لمتعدد الجوانب.

Urchade Zaratiana, Mary Newhauser, George Hurn-Maloney, Ash Lewis2026-05-11
💬 NLP

Position: Mechanistic Interpretability Must Disclose Identification Assumptions for Causal Claims

تجادل هذه الورقة بأن أبحاث التفسير الآلي غالباً ما تخلط بين مقاييس التحقق والتعريف السببي من خلال الفشل في التصريح صراحةً بالافتراضات الضرورية، وتقترح معيار إفصاح جديداً يتطلب من المؤلفين توضيح استراتيجيات التعريف الخاصة بهم ومدى متانة ادعاءاتهم السببية بشكل جلي.

Zezheng Lin, Fengming Liu2026-05-11
💬 NLP

Fast Byte Latent Transformer

يعالج محول البايت الكامن (BLT) عقبة البطء في التوليد لنماذج اللغة على مستوى البايت من خلال تقديم ثلاثة متغيرات مبتكرة — وهي BLT-Diffusion وBLT-Self-speculation وBLT-Diffusion+Verification — التي تستفيد من تقنيات التوليد المتوازي وفك التشفير التخميني لتقليل زمن انتقال الاستدلال وتكاليف عرض نطاق الذاكرة بشكل كبير مع الحفاظ على جودة عالية.

Julie Kallini, Artidoro Pagnoni, Tomasz Limisiewicz, Gargi Ghosh, Luke Zettlemoyer, Christopher Potts, Xiaochuang Han, S (…)2026-05-11
💬 NLP

Accurate and Efficient Statistical Testing for Word Semantic Breadth

تقترح هذه الورقة اختبار تبديل محاذٍ لـ "هاوسهولدر" (Householder) ومعززاً بمعالجات الرسوميات (GPU)، يميز بدقة بين الفروق الحقيقية في الاتساع الدلالي للكلمات وبين التباينات الاتجاهية، مما يقلل من خطأ النوع الأول بنسبة 32.5% ويحقق تسريعاً بمقدار 23 ضعفاً مقارنة بالأساسات المعتمدة على وحدة المعالجة المركزية (CPU).

Yo Ehara2026-05-11
💬 NLP

CA-SQL: Complexity-Aware Inference Time Reasoning for Text-to-SQL via Exploration and Compute Budget Allocation

يُعد CA-SQL إطار عمل مبتكر لتحويل النص إلى SQL يعزز الاستدلال على المعايير المرجعية الصعبة من خلال توسيع نطاق استكشاف العرض ديناميكيًا بناءً على تعقيد المهمة، وتوظيف بذر المطالبات التطوري، واستخدام آلية التصويت لتحقيق أداء رائد في مجموعة بيانات BIRD باستخدام نموذج GPT-4o-mini فقط.

James Petullo, Nianwen Xue2026-05-11
💬 NLP

The Memory Curse: How Expanded Recall Erodes Cooperative Intent in LLM Agents

تكشف هذه الورقة أن توسيع نوافذ السياق في وكلاء النماذج اللغوية الكبيرة غالبًا ما يؤدي إلى إطلاق "لعنة الذاكرة" التي تؤدي بشكل منهجي إلى تآكل النوايا التعاونية في المعضلات الاجتماعية متعددة الوكلاء عبر تضخيم أنماط الاستدلال السلبية، وهي ظاهرة يمكن التخفيف من حدتها من خلال الضبط الدقيق المستهدف على آثار استشرافية أو تطهير الذاكرة.

Jiayuan Liu, Tianqin Li, Shiyi Du, Xin Luo, Haoxuan Zeng, Emanuel Tewolde, Tai Sing Lee, Tonghan Wang, Carl Kingsford, V (…)2026-05-11
💬 NLP

Conformal Path Reasoning: Trustworthy Knowledge Graph Question Answering via Path-Level Calibration

تقترح هذه الورقة "الاستدلال المساري المطابق" (CPR)، وهو إطار عمل موثوق للإجابة على أسئلة الرسوم البيانية المعرفية يجمع بين معايرة المسار على مستوى الاستعلام وشبكة قيمة متبقية مطابقة مدربة باستخدام خوارزمية (PUCT) لتحسين معدلات التغطية التجريبية بشكل كبير مع تقليل أحجام مجموعات التنبؤ مقارنة بالطرق الحالية.

Shuhang Lin, Chuhao Zhou, Xiao Lin, Zihan Dong, Kuan Lu, Zhencan Peng, Jie Yin, Dimitris N. Metaxas2026-05-11