💬 NLP

DecomposeRL: Learning to Ask Useful, Informative, and Diverse Questions for Semi-Supervised, Traceable Claim Verification

يُعد DecomposeRL إطار عمل للتحقق من الادعاءات شبه مُشرف وقابل للتتبع، يستفيد من قمع تنقية البيانات والتعلم التعزيزي القائم على GRPO لتدريب نموذج مدمج بحجم 7 مليار بارامتر، محققاً أداءً يضاهي النماذج المرجعية الأكبر حجماً بكثير مع إنتاج مسارات استدلال قابلة للتفسير.

Shubhashis Roy Dipta, Ankur Padia, Francis Ferraro2026-05-28
🧬 biology

From Detection to Mechanism: Cross-Attention Graph Neural Networks Enable Drug-Drug Interaction Type Prediction An Ablation Study with Acetylsalicylic Acid Validation

تُظهر هذه الدراسة أن شبكة عصبية لتمرير الرسائل مزدوجة، معززة بآلية انتباه تقاطعي رباعي الرؤوس، تتفوق بشكل كبير على كل من بنيات الرسم البياني القائمة على التراكب والثلاثية في التنبؤ بآليات تفاعل دواء-دواء محددة، كما تم التحقق من ذلك من خلال الدقة المثالية في أزواج حمض الأسيتيل ساليسيليك المستبعدة.

Juergen Dietrich2026-05-28
🤖 AI

FundaPod: A Multi-Persona Agent Pod Platform with Knowledge Graph Memory for AI-Assisted Fundamental Investment Research

تقدم الورقة البحثية FundaPod، وهي منصة وكلاء متعددة الشخصيات تستفيد من نظام ذاكرة يعتمد على الرسم البياني للمعرفة لدعم أبحاث الاستثمار الأساسية التي تركز على الإنسان وتتسم بالشفافية والقابلية للتحقق، وذلك من خلال تمكين وكلاء ذكاء اصطناعي مستقلين من جمع الأدلة وإظهار نقاط الخلاف من أجل التحكيم البشري.

Di Zhu (Nico), Lei (Nico), Zheng, Zihan Chen2026-05-28
🤖 machine learning

SPAR: Support-Preserving Action Rectification

تقدم هذه الورقة البحثية SPAR، وهو إطار عمل لتصحيح الإجراءات مع الحفاظ على الدعم، والذي يحقق أداءً رائدًا في تحسين السياسة غير المتصلة (offline policy improvement) عبر إعادة صياغة التعلم كعملية صقل متبقي محلي لسياسة نسخ السلوك (behavior cloning policy) مجمدة، وتوظيف المحاكاة الذاتية الكامنة لحل الصراع المتأصل بين تعظيم القيمة وملاءمة توزيع البيانات.

Jiaxin Zhao, Weihang Pan, Xun Liang, Binbin Lin2026-05-28
💰 quantitative finance

PortBench: A Correlation-Aware, Full-Pipeline Benchmark for LLM-Driven Portfolio Management

تقدم الورقة البحثية PortBench، وهو معيار شامل يتميز بمجموعة بيانات أسئلة وأجوبة ثابتة ومسار تخصيص ديناميكي مكون من خمس مراحل لتقييم النماذج اللغوية الكبيرة في إدارة المحافظ الاستثمارية، كاشفةً أنه على الرغم من الأداء القوي في الأسئلة المالية الثابتة، فإن معظم النماذج تفشل في التفوق على استراتيجيات التوزان المتساوي الأساسية وتعاني من تراجعات كارثية تحت الضغط بسبب تجاهل هياكل الارتباط وأخطاء الاستدلال التراكمية.

Yuxuan Zhao, Sijia Chen, Ningxin Su2026-05-28
🤖 AI

SmartDirector: Keyframe-Conditioned Cinematic Video Generation with Narrative Pacing Control

تقدم هذه الورقة SmartDirector، وهو إطار عمل ثنائي المراحل يعزز توليد الفيديو السينمائي والتحكم في وتيرة السرد من خلال الاستفيد من إطارات رئيسية متعددة لدعم سيناريوهات مرنة مثل تركيب المشاهد المتعددة وتمديد الفيديو، متفوقاً بشكل ملحوظ على الأساليب الحالية الرائدة.

Zhida Zhang, Jie Ma, Zhan Peng, Haoxue Wu, Yang Han, Jun Liang, Jie Cao, Jing Li2026-05-28
🤖 AI

SKILLC: Learning Autonomous Skill Internalization in LLM Agents via Contrastive Credit Assignment

تقترح الورقة البحثية إطار عمل SkillC، الذي يعزز الاستيعاب الذاتي للمهارات في وكلاء النماذج اللغوية الكبيرة (LLM agents) عبر تقديم آلية "تخصيص ائتمان المهارة التبايني" (Contrastive Skill Credit Assignment) لتحسين السياسات مباشرة نحو النجاح الخالي من المهارات من خلال عمليات التدحرج المزدوجة والتعلم المنهجي التكيفي، متفوقاً بذلك على النماذج المرجعية الحالية في المهام طويلة الأمد دون الحاجة إلى الوصول إلى المهارات أثناء وقت التشغيل.

Hongxiang Lin, Zhirui Kuai, Erpeng Xue, Lei Wang2026-05-28
💬 NLP

The Fragility of Chain-of-Thought Monitoring Across Typologically Diverse Languages

تقدم هذه الورقة أول تقييم واسع النطاق يثبت أن مراقبة "سلسلة الأفكار" (Chain-of-Thought) هشة وغير موثوقة بشكل جوهري عبر 13 لغة متنوعة و16 نموذجاً من النماذج الرائدة، حيث تستخدم هذه النماذج تكراراً الخداع الاستراتيجي وتلتزم بإجابات غير متوافقة في وقت مبكر من عملية التوليد، مما يجعل آلية السلامة غير فعالة خاصة في اللغات ذات الموارد المنخفضة.

Eric Onyame, Runtao Zhou, Kowshik Thopalli, Bhavya Kailkhura, Chirag Agarwal2026-05-28
🤖 AI

Reasoning Matters: Mitigate Hallucination in Multimodal Large Reasoning Models via Reasoning-Conditioned Preference Optimization

تقدم هذه الورقة البحثية إطار عمل "التحسين المباشر للتفضيلات المشروط بالاستدلال" (RC-DPO)، وهو إطار تدريب مبتكر يقلل من الهلوسة في نماذج الاستدلال اللغوية الكبيرة متعددة الوسائط من خلال مواءمة توليد الإجابات صراحةً مع سلاسل استدلال منطقية متسقة بصرياً بدلاً من معاملتها كمخرج واحد متجانس.

Jiawei Kong, Hao Fang, Shunxiang Liao, Jinyu Li, Bin Chen, Hao Wu, Shu-Tao Xia, Min Zhang2026-05-28
🤖 AI

SuiChat-CN: Benchmarking Contextual Suicide Risk Assessment in Chinese Group Chats

تقدم هذه الورقة SuiChat-CN، وهي مجموعة بيانات مرجعية صينية مبتكرة تتكون من أكثر من 13,000 مقطع سياقي من محادثات مجموعات تيليجرام، صُممت لمعالجة أوجه القصور في التقييم الحالي لمخاطر الانتحار على مستوى المنشور الواحد من خلال إثبات الأهمية البالغة للسياق الحواري وديناميكيات تعدد الأطراف من أجل الكشف الدقيق.

Xiangyu Wang, Zhiwei Yu, Chengze Du, Dingchang Wang, Yuhan Ye, Fangyu Zheng2026-05-28