💬 NLP

TRACE: Temporal Retrieval with Anchored and Convergent Evidence for Long-Horizon Video Understanding

تقدم هذه الورقة VES-Bench، وهو معيار مرجعي جديد لتدقيق ما إذا كانت أساليب فهم الفيديوهات الطويلة تقوم بفك تشفير الإطارات التي تغطي جميع الأدلة الضرورية، وتقترح TRACE، وهو وكيل لا يتطلب تدريباً يقوم ببناء حزم أدلة بشكل تكراري لتحقيق دقة إجابة فائقة بتكاليف إطارات أقل بكثير مقارنة بفك التشفير الموحد.

Pengyiang Liu, Junbo Niu, Xiaoyang Hu, Zhongyue Shi, Zitian Wang, Linjiang Huang, Si Liu2026-08-25
🤖 machine learning

BLADE: Bilevel Low-rank Augmented-Lagrangian Erasure for LLM Unlearning

تقدم الورقة البحثية BLADE، وهو إطار عمل ثنائي المستوى مقيد يستخدم فقدان الإنتروبيا المكبوت (clamped-entropy loss)، ولاجرانج المعزز غير المتماثل، وآليات إصلاح قائمة على LoRA لتحقيق عملية نسيان (unlearning) قوية وقابلة للتوسع للنماذج اللغوية الكبيرة تتفوق بشكل كبير على الخطوط المرجعية الحالية عبر معايير متعددة مع الحفاظ على الاستقرار تحت ظروف التوسع والنسيان المتكرر.

Md Toufikuzzaman, Ahmad Mousavi, Dongwon Lee2026-08-25
🤖 AI

ExecRubrics: Executable Tool-Augmented Rubrics for Verifiable and Efficient Long-Form Evaluation

تقدم الورقة البحثية ExecRubics، وهو إطار عمل يحول معايير التقييم الغامضة المكتوبة باللغة الطبيعية إلى برامج بايثون قابلة للتنفيذ والتحقق، مما يحقق تقييماً أسرع وأكثر قابلية للتفسير، وغالباً ما يكون أكثر دقة للاستجابات طويلة التنسيق مقارنةً بحكام النماذج اللغوية الكبيرة التقليدية القائمة على الصندوق الأسود عبر مختلف الاختبارات المعيارية.

Kaustubh D. Dhole, Charles L. A. Clarke, Eugene Y. Agichtein2026-08-25
💬 NLP

GeoRisk-RAG: A Hierarchy-Aware Risk Framework for Improving RAG Reliability through Selective Answering

يُعد GeoRisk-RAG إطار عمل مبتكرًا يعتمد على الهيكلية الهرمية، يعمل على تعزيز موثوقية التوليد المعزز بالاسترجاع في المجالات الجيومكانية من خلال استخدام مقياس مسافة قائم على المخططات الموجهة غير الحلقية (DAG) لتقدير الصلاحية الجغرافية وتمكين الإجابة الانتقائية، مما يقلل بشكل كبير من معدلات الثقة الزائفة للأسئلة المعتمدة على الموقع مقارنة بالنماذج المرجعية القائمة على التشابه الدلالي القياسي.

Meenu Ravi, Shailik Sarkar, Lulwah AlKulaib, Yordanos Tessema, Chang-Tien Lu2026-08-25
💬 NLP

Enrich-Retrieve-Rank: Scaling Capability Discovery Beyond In-Context Routing

تقدم هذه الورقة "الإثراء-الاسترجاع-التصنيف" (Enrich-Retrieve-Rank)، وهو مسار قابل للتوسع لاكتشاف القدرات يستبدل التوجيه داخل السياق غير الفعال بنهج إثراء غير متصل بالإنترنت واسترجاع ثم تصنيف متصل بالإنترنت، مما يظهر دقة أعلى بكثير وتكاليف أقل من الطرق المرجعية مع نمو أنظمة الوكلاء من مئات إلى آلاف المكونات.

Nazib Sorathiya, Daniel Zhang, Bardiya Akhbari2026-08-25
💬 NLP

WnW: Waxing-and-Waning KV Cache for Long-Form Speech LLMs

تقدم هذه الورقة البحثية WnW، وهي استراتيجية ديناميكية لإدارة ذاكرة التخزين المؤقت لـ KV تصنف رؤوس الانتباه إلى أدوار: مرساة (anchor)، ومد جزر (tidal)، وثابتة (fixed)، لتمكين المعالجة الفعالة للكلام طويل المدى من خلال الاحتفاظ بـ 20% فقط من الرموز الصوتية على وحدة معالجة الرسومات مع الحفاظ على دقة تقارب دقة الذاكرة الكاملة عبر الاستدعاء الانتقائي بين وحدة المعالجة المركزية ووحدة معالجة الرسومات.

Yiming Yao, Chenyang Lyu, Xuanfan Ni, Longyue Wang, Weihua Luo, Yazheng Yang, Jinsong Su2026-08-25
💬 NLP

DiaRelay: Relaying Dialogue Context with a Constant-Size Memory for Emotion Recognition in Conversation

تقترح الورقة البحثية DiaRelay، وهو محول خفيف الوزن يعتمد على تقنية LoRA يُمكّن النماذج اللغوية الكبيرة من الحفاظ على ذاكرة ثابتة الحجم على مستوى الحوار للتعرف على العواطف في المحادثات، مما يسمح بالتقاط الإشارات العاطفية طويلة المدى بفعالية دون إعادة تشفير التاريخ أو زيادة طول السياق، مع تحقيق أداء رائد مع الحد الأدنى من المعلمات القابلة للتدريب.

Zihao Zhou, Bin Yang, Jinghui Qin, Kebing Jin2026-08-25
💬 NLP

Beyond Factual Knowledge: Benchmarking and Learning Step-Level Procedural Rule Reasoning in Large Language Models

تقدم هذه الورقة البحثية RuleWorld، وهو معيار واسع النطاق لتقييم الاستدلال الإجرائي على مستوى الخطوات، وتقترح DynaRule، وهو إطار عمل شامل (end-to-end) يحسن بشكل كبير أداء النماذج اللغوية الكبيرة في مهام الاستدلال المعقدة متعددة الخطوات من خلال الحقن الديناميكي وإعادة الانتباه إلى القواعد داخل ذاكرة التخزين المؤقت (KV cache).

Bohan Yu, Pengfei Cao, Chen Han, Chenxi Zhou, Zhiheng Zhang, Zhiyang Xie, Wenhao Teng, Xiangwen Liao, Jun Zhao, Kang Liu2026-08-25
💬 NLP

XTC: Head-Aware Sampling by Excluding Top Choices

تقدم الورقة البحثية استراتيجية XTC (استبعاد الخيارات العليا)، وهي استراتيجية فك تشفير خفيفة الوزن تعمل على إزالة الرموز المهيمنة ذات الاحتمالية العالية بشكل انتقائي لتعزيز تنوع التوليد والإبداع بشكل كبير مع الحفاظ على السلاسة ودقة اتباع التعليمات عبر مختلف النماذج اللغوية الكبيرة.

Philipp Emanuel Weidmann, Allen Roush, Judah Goldfeder, Sanjay Basu, Ravid Shwartz-Ziv2026-08-25
💬 NLP

Don't Repeat Yourself: Stopping Verbatim Loops at Sampling Time

تقدم الورقة البحثية تقنية "لا تكرر نفسك" (DRY)، وهي تعديل للوغاريتمات (logits) عند وقت أخذ العينات يعمل على تقليل التكرار الحرفي في النماذج اللغوية الكبيرة بفعالية عبر معاقبة الرموز (tokens) التي تمدد تطابقات لاحقة دقيقة من السياق السابق، مما يحسن التنوع المعجمي والطلاقة دون تدهور في الأداء أو الحاجة إلى إعادة تدريب النموذج.

Philipp Emanuel Weidmann, Allen Roush, Judah Goldfeder, Sanjay Basu, Ravid Shwartz-Ziv2026-08-25