🤖 AI

SmartDirector: Keyframe-Conditioned Cinematic Video Generation with Narrative Pacing Control

تقدم هذه الورقة SmartDirector، وهو إطار عمل ثنائي المراحل يعزز توليد الفيديو السينمائي والتحكم في وتيرة السرد من خلال الاستفيد من إطارات رئيسية متعددة لدعم سيناريوهات مرنة مثل تركيب المشاهد المتعددة وتمديد الفيديو، متفوقاً بشكل ملحوظ على الأساليب الحالية الرائدة.

Zhida Zhang, Jie Ma, Zhan Peng, Haoxue Wu, Yang Han, Jun Liang, Jie Cao, Jing Li2026-05-28
🤖 AI

SKILLC: Learning Autonomous Skill Internalization in LLM Agents via Contrastive Credit Assignment

تقترح الورقة البحثية إطار عمل SkillC، الذي يعزز الاستيعاب الذاتي للمهارات في وكلاء النماذج اللغوية الكبيرة (LLM agents) عبر تقديم آلية "تخصيص ائتمان المهارة التبايني" (Contrastive Skill Credit Assignment) لتحسين السياسات مباشرة نحو النجاح الخالي من المهارات من خلال عمليات التدحرج المزدوجة والتعلم المنهجي التكيفي، متفوقاً بذلك على النماذج المرجعية الحالية في المهام طويلة الأمد دون الحاجة إلى الوصول إلى المهارات أثناء وقت التشغيل.

Hongxiang Lin, Zhirui Kuai, Erpeng Xue, Lei Wang2026-05-28
💬 NLP

The Fragility of Chain-of-Thought Monitoring Across Typologically Diverse Languages

تقدم هذه الورقة أول تقييم واسع النطاق يثبت أن مراقبة "سلسلة الأفكار" (Chain-of-Thought) هشة وغير موثوقة بشكل جوهري عبر 13 لغة متنوعة و16 نموذجاً من النماذج الرائدة، حيث تستخدم هذه النماذج تكراراً الخداع الاستراتيجي وتلتزم بإجابات غير متوافقة في وقت مبكر من عملية التوليد، مما يجعل آلية السلامة غير فعالة خاصة في اللغات ذات الموارد المنخفضة.

Eric Onyame, Runtao Zhou, Kowshik Thopalli, Bhavya Kailkhura, Chirag Agarwal2026-05-28
🤖 AI

Reasoning Matters: Mitigate Hallucination in Multimodal Large Reasoning Models via Reasoning-Conditioned Preference Optimization

تقدم هذه الورقة البحثية إطار عمل "التحسين المباشر للتفضيلات المشروط بالاستدلال" (RC-DPO)، وهو إطار تدريب مبتكر يقلل من الهلوسة في نماذج الاستدلال اللغوية الكبيرة متعددة الوسائط من خلال مواءمة توليد الإجابات صراحةً مع سلاسل استدلال منطقية متسقة بصرياً بدلاً من معاملتها كمخرج واحد متجانس.

Jiawei Kong, Hao Fang, Shunxiang Liao, Jinyu Li, Bin Chen, Hao Wu, Shu-Tao Xia, Min Zhang2026-05-28
🤖 AI

SuiChat-CN: Benchmarking Contextual Suicide Risk Assessment in Chinese Group Chats

تقدم هذه الورقة SuiChat-CN، وهي مجموعة بيانات مرجعية صينية مبتكرة تتكون من أكثر من 13,000 مقطع سياقي من محادثات مجموعات تيليجرام، صُممت لمعالجة أوجه القصور في التقييم الحالي لمخاطر الانتحار على مستوى المنشور الواحد من خلال إثبات الأهمية البالغة للسياق الحواري وديناميكيات تعدد الأطراف من أجل الكشف الدقيق.

Xiangyu Wang, Zhiwei Yu, Chengze Du, Dingchang Wang, Yuhan Ye, Fangyu Zheng2026-05-28
🤖 AI

Harness-Bench: Measuring Harness Effects across Models in Realistic Agent Workflows

يُعد Harness-Bench معياراً تشخيصياً يتألف من 106 مهمة واقعية ومعزولة، يعمل على تقييم كيفية تأثير تكوينات طبقة النظام المختلفة (الحواجز/البيئات التنفيذية) على أداء وكلاء النماذج اللغوية الكبيرة، كاشفاً أن نتائج التنفيذ تتباين بشكل كبير عبر الاقتران بين النموذج والحاجز، ومسلطاً الضوء على الحاجة إلى الإبلاغ عن قدرات الوكيل على مستوى التكوين بدلاً من نسبها حصرياً إلى النموذج الأساسي.

Yilun Yao, Xinyu Tan, Chao-Hsuan Liu, Yaoming Li, Zhengyang Wang, Wenhan Yu, Zhewen Tan, Yuxuan Tian, Guangxiang Zhao, L (…)2026-05-28
⚛️ quantum physics

Do We Really Need Quantum Machine Learning?: A Multidimensional Empirical Study

تقدم هذه الورقة دراسة تجريبية متعددة الأبعاد تُظهر أنه في حين أن آلات المتجهات الداعمة الكمومية (QSVM) والشبكات العصبية التلافيفية الكمومية (QCNN) تتسبب عموماً في أوقات تشغيل حسابية أعلى من نظيراتها الكلاسيكية، إلا أنها توفر دقة تصنيف فائقة عند المقاييس الأكبر وكفاءة محسنة بشكل كبير في المعلمات والذاكرة، لا سيالما بالنسبة للشبكات العصبية التلافيفية الكمومية (QCNN).

Sudip Vhaduri, Ryan Gammon, Sayanton Dibbo2026-05-28
💬 NLP

Pressure-Testing Deception Probes in LLMs: Scaling, Robustness, and the Geometry of Deceptive Representations

تقيم هذه الورقة البحثية بشكل منهجي مجسات الخداع في عائلة نماذج Gemma 3، مظهرةً أنه بينما تنهار المجسات الخطية تحت تأثير التحولات الأسلوبية بسبب الضيق التوزيعي بدلاً من الحدود المعمارية، فإن المجسات متعددة الأبعاد المعززة بالأسلوب يمكنها استعادة الكشف شبه المثالي بقوة عبر مختلف المقاييس من خلال الاستفضاء بالميزات الموزعة دون العتبة.

Sachin Kumar2026-05-28
🤖 AI

ROVER: Routing Object-Centric Visual Evidence for Grounded Multi-Image Reasoning

تقدم الورقة البحثية ROVER، وهو ملحق خفيف الوزن وقابل للتعلم للنماذج اللغوية الكبيرة متعددة الوسائط، يعزز الاستدلال متعدد الصور القائم على التأسيس من خلال توجيه الأدلة البصرية المتمحورة حول الأشياء بكفاءة عبر آلية ثلاثية الرموز (token triplet) الخاصة بكل خطوة، محققاً أداءً هو الأفضل في فئته على اختبارات معيارية مثل MM-GCoT وVideoEspresso دون المساس بالفهم الشامل للمشهد.

Guannan Lv, Ren Nie, Hongjian Dou2026-05-28
🤖 AI

Geometry of Human Perceptual Domains Emerges Transiently in LLM Representations

تُظهر هذه الورقة البحثية أن الهندسات الإدراكية الشبيهة بالبشر عبر مجالات مثل اللون والعاطفة تظهر بشكل عابر ضمن الطبقات المتوسطة للنماذج اللغوية الكبيرة، متبعةً مساراً تطورياً متميزاً رغم غياب التدريب الإدراكي المباشر.

Simardeep Singh, Paras Chopra2026-05-28