💬 NLP

Plans You Can Check: Verifier-Grounded Learning of an Open-Weight Planner for Executable Video-Editing

تقدم هذه الورقة RefineCut، وهو مخطط مفتوح الأوزان لتحرير الفيديو القابل للتنفيذ يستفيد من مُحقِّق حتمي لاستخلاص إصلاحات متعددة المعلمين وتحسين التفضيلات، مما يمكّن نموذجاً بحجم 8 مليار بارامتر من التفوق على المعلمين الرائدين في معيار مرجعي جديد دون الحاجة إلى استدعاء المعلمين أثناء الاستدلال.

Haoyu Wang, Cheng Feng, Liuyang Bian, Ruiyang Huang, Lei Wei, Yafei Wen, Xiaoxin Chen, Xiaoying Tang2026-08-27
💬 NLP

Reconstructing the Right Episode: Evaluating Interleaved Conversational Memory Beyond Long Context

تقدم هذه الورقة SCALE-QA، وهو معيار مصمم لتقييم أنظمة الذاكرة في سلاسل المحادثات المسطحة والمتنوعة المواضيع عبر اختبار قدرتها على تحديد الحلقات الماضية ذات الصلة السببية، وتقترح TSIM، وهي طريقة إعادة بناء ذاكرة هرمية تتفوق بشكل كبير على النماذج المرجعية الحالية ذات السياق الطويل واسترجاع المعلومات المعزز (RAG) في الحفاظ على سلامة الحلقات.

Zhexi Feng, Ruiyi Zhang, Yongbo Yang, Pengtao Xie2026-08-27
💬 NLP

Think-Probe-Respond: Improving Large Language Models as Judges of Research Idea Novelty

تقدم هذه الورقة طريقة "التفكير-الاستقصاء-الاستجابة" (TPR)، وهي طريقة خفيفة الوزن تستقصي أحكام الجدة الكامنة من الحالات الخفية للنموذج لتصحيح انحيازه المنهجي نحو تقييمات "الجدة المتوسطة"، مما يحسن بشكل كبير من دقة النماذج اللغوية الكبيرة في تقييم جدة الأفكار البحثية.

Tim Schopf, Tobias Schreieder, Akiko Aizawa2026-08-27
💬 NLP

Overview of SHROOM-Visions 2026: A Shared Task on Hallucination Detection in Large Vision-Language Models

نجحت مهمة SHROOM-Visions 2026 المشتركة، التي استضافتها ورشة عمل UncertaiNLP، في إشراك 27 فريقاً لتطوير أنظمة مستقلة عن النماذج للكشف عن الهلوسات دقيقة التفاصيل في النماذج اللغوية البصرية الكبيرة وتصنيفها عبر أربع لغات، محققةً تحسينات ملحوظة في الأداء مقارنة بالنماذج المرجعية باستخدام مجموعة بيانات SHEEP.

Raúl Vázquez, Aman Sinha, Chuyuan Li, Claudio Savelli, Eduardo Calò, Emilio Raimond, Stella Frank, Hengyu Luo, Flavio Gi (…)2026-08-27
🤖 machine learning

Why Does Graph Learning Fail to Fully Benefit from a Text Teacher?

تتقصى هذه الورقة البحثية سبب فشل نموذج متعدد الوسائط يجمع بين شبكة عصبية رسومية ذات تعلم ذاتي واستراتيجية تحسين تبادلي مع نموذج لغوي معلم في تحسين الأداء التنبؤي، حيث حددت ستة عوامل رئيسية تشمل مقايضات قوة المرتكز، وعدم توافق مساحات التمثيل، وقوى التحسين المتضاربة.

Fumiaki Kimino (SOKENDAI), Ryoma Sato (SOKENDAI, National Institute of Informatics)2026-08-27
💬 NLP

MoganBert-TR: A Turkish Encoder Foundation Model Trained from Scratch with a CLM-to-MLM Curriculum

تقدم هذه الورقة البحثية MoganBert-TR، وهو نموذج تأسيسي لترميز اللغة التركية بـ 149 مليون معلمة، تم تدريبه من الصفر باستخدام منهج تعليمي مبتكر من CLM إلى MLM وجدولة متخصصة للسياق الطويل، والذي يحقق أداءً هو الأفضل في فئته على معايير معالجة اللغات الطبيعية التركية ويُنتج نموذج تضمين عالي الكفاءة يصل إلى 99.5% من درجة نموذجه المعلم المكون من 7.57 مليار معلمة.

Furkan Yilmaz, Habibe Aleyna Tasdemir, Muhammed Faruk Gozay2026-08-27
💬 NLP

Localize-Then-Decide Guarantees for LLM Judgments

تقترح هذه الورقة إطار عمل "التحديد المحلي ثم القرار" (Localize-Then-Decide) الذي يجمع بين التنبؤ المطابق (conformal prediction) لتوليد قائمة مختصرة ذات احتمالية عالية مع قاعدة اختيار قائمة تعتمد على الثقة المعايرة، مما يؤدي إلى استعادة موثوقية تقديرات الثقة وتمكين ضمانات قوية لأحكام النماذج اللغوية الكبيرة عبر أحجام مرشحين متفاوتة.

Xinyu Li, Yi Zhou, Guanqun Cao, Zeyu Fu, Tianjin Huang, Gaojie Jin2026-08-27
💬 NLP

Unfolding Scientific Papers into Multi-Turn Generation Trajectories for Continued Pre-Training

تقدم هذه الورقة مسار معالجة يحول الأوراق العلمية المهيكلة إلى مسارات توليد متعددة الأدوار من أجل التدريب المسبق المستمر والاختبار المعياري، مما يثبت أن هذا النهج يعزز قدرات الكتابة الأكاديمية بشكل كبير مع الحفاظ على الاستدلال العام والاستيعاب للمستندات الطويلة.

Qiankai Xu, Qiguang Chen, Zixin Su, Wenhao Huang, Yue Gao, Jiaheng Liu, Ge Zhang2026-08-27
💬 NLP

Skill Issue: Are Skills Language-Invariant in LLMs?

تُثبت هذه الورقة أن النماذج اللغوية الكبيرة تُظهر تباينات ملموسة وقابلة للقياس في المهارات عبر اللغات المختلفة، وذلك باستخدام إطار عمل "اللعب الذاتي" متعدد اللغات لإظهار أن النموذج نفسه يمكن أن يُبدي نقاط قوة، وقدرات استدلال، وسلوكيات استراتيجية متفاوتة بشكل ملحوظ اعتماداً فقط على واجهة اللغة المستخدمة.

Bobby Cheng, Adam Gaber, Zhengyuan Liu, Catherine Arnett, Omer Goldman, Cheston Tan, Leshem Choshen2026-08-27
💬 NLP

Key Point Analysis Needs Structure Recovery: Task Definition, Dataset Diagnosis, and a Structure-Aware Benchmark

تعيد هذه الورقة تعريف تحليل النقاط الرئيسية كمسألة تنبؤ مهيكل، وتشخص قيوداً حرجة في المعايير المرجعية الحالية، وتقدم معياراً مرجعياً جديداً مدركاً للهيكل ومعتمداً على العنصر البشري في التوسيم، يُظهر أداءً فائقاً في التجميع، وجودة النقاط الرئيسية، والتغطية، وتقدير الانتشار.

Zhiqiang Shi, Oana Cocarascu2026-08-27