💬 NLP

FPMoE: A Sparse Mixture-of-Experts Approach to Functional Code Generation

يُعد FPMoE نموذجاً خفيف الوزن ومفتوح المصدر لتوليد الكود، يستفيد من بنية "خليط الخبراء" (Mixture-of-Experts) المتفرقة التي تضم خبراء مخصصين وخبراء مشتركين للتغلب على قيود النماذج الحالية في لغات البرمجة الوظيفية، محققاً أداءً فائقاً في لغات Haskell وOCaml وScala مع مضاهاة نماذج أكبر بكثير بامتلاكه 3 مليارات معلمة نشطة فقط.

Loc Pham, Lang Hong Nguyet Anh, Thanh Le-Cong2026-05-28
🤖 AI

TCP-MCP: Landscape-Guided Co-Evolution of Prompts and Communication Topologies for Multi-Agent Systems

تقدم الورقة البحثية TCP-MCP، وهو إطار عمل للتطور المشترك يعمل على تحسين مطالبات الوكلاء وطوبولوجيا الاتصال بشكل مشترك لتحقيق دقة عالية في الاختبارات المعيارية المعقدة مع تقليل تكاليف الرموز (tokens) بشكل كبير مقارنة بالأنظمة متعددة الوكلاء الحالية.

Yi Ding, Zijie Xuan, Haowei Zhou, Zhenyu Ju, Xiaoxiao Dong, Jingwen Zhang, Xingyu Zhu, Leixin Sun, Haochi Zhang2026-05-28
🤖 AI

When Context Flips, Safety Breaks: Diagnosing Brittle Safety in Aligned Language Models

تقدم هذه الورقة "تقييم قلب السياق" لتشخيص "السلامة الهشة" في النماذج اللغوية المتوافقة، كاشفةً عن التزامها الصارم بقواعد السلامة حتى عندما تجعل التغيرات الموقفية تلك الأفعال ضارة، وهو فشل ناتج عن تجاوزات السياسة بدلاً من سوء الفهم، مما يكشف عن حدود الضوابط القياسية القائمة على مستوى الإجراء ويحفز الحلول المعمارية المدركة للحالة.

Dasol Choi, Alex Kwon2026-05-28
🤖 AI

MolLingo: Molecule-Native Representations for LLM-Powered Scientific Agents

إن MolLingo هو نظام متعدد الوكلاء يعمل على أتمتة تصميم الجزيئات من خلال تنسيق وكلاء متخصصين مع ذاكرة مشتركة وتمثيل تجزئة مبتكر قائم على BRICS لربط البنية الكيميائية بالدلالات اللغوية للنماذج اللغوية الكبيرة، مما يحقق أداءً هو الأفضل في حالته في تحسين العلاجات ويتفوق على كل من النماذج اللغوية الكبيرة الرائدة والنماذج المرجعية المتخصصة.

Thao Nguyen, Heng Ji2026-05-28
🤖 AI

Fine-Tuned LLM as a Complementary Predictor Improving Ads System

تقدم هذه الورقة نظاماً إعلانياً بمقياس إنتاجي يدمج نموذج لغة كبير مفتوح المصدر ومضبوط بدقة كمتنبئ إضافي تكميلي للتنبؤ بالمعلنين المحتملين من ملفات تعريف المستخدمين، مما يعزز عملية توليد المرشحين ويوفر احتمالات معرفية لعمليات الترتيب اللاحقة لتحقيق تحسينات تجارية كبيرة على المستويين التجريبي والفعلي.

Hui Yang, Daiwei He, Kevin Jiang, Taejin Park, Kungang Li, Jiajun Luo, Yuying Chen, Xinyi Zhang, Sihan Wang, Haoyu He, Y (…)2026-05-28
💬 NLP

DecomposeRL: Learning to Ask Useful, Informative, and Diverse Questions for Semi-Supervised, Traceable Claim Verification

يُعد DecomposeRL إطار عمل للتحقق من الادعاءات شبه مُشرف وقابل للتتبع، يستفيد من قمع تنقية البيانات والتعلم التعزيزي القائم على GRPO لتدريب نموذج مدمج بحجم 7 مليار بارامتر، محققاً أداءً يضاهي النماذج المرجعية الأكبر حجماً بكثير مع إنتاج مسارات استدلال قابلة للتفسير.

Shubhashis Roy Dipta, Ankur Padia, Francis Ferraro2026-05-28
🧬 biology

From Detection to Mechanism: Cross-Attention Graph Neural Networks Enable Drug-Drug Interaction Type Prediction An Ablation Study with Acetylsalicylic Acid Validation

تُظهر هذه الدراسة أن شبكة عصبية لتمرير الرسائل مزدوجة، معززة بآلية انتباه تقاطعي رباعي الرؤوس، تتفوق بشكل كبير على كل من بنيات الرسم البياني القائمة على التراكب والثلاثية في التنبؤ بآليات تفاعل دواء-دواء محددة، كما تم التحقق من ذلك من خلال الدقة المثالية في أزواج حمض الأسيتيل ساليسيليك المستبعدة.

Juergen Dietrich2026-05-28
🤖 AI

FundaPod: A Multi-Persona Agent Pod Platform with Knowledge Graph Memory for AI-Assisted Fundamental Investment Research

تقدم الورقة البحثية FundaPod، وهي منصة وكلاء متعددة الشخصيات تستفيد من نظام ذاكرة يعتمد على الرسم البياني للمعرفة لدعم أبحاث الاستثمار الأساسية التي تركز على الإنسان وتتسم بالشفافية والقابلية للتحقق، وذلك من خلال تمكين وكلاء ذكاء اصطناعي مستقلين من جمع الأدلة وإظهار نقاط الخلاف من أجل التحكيم البشري.

Di Zhu (Nico), Lei (Nico), Zheng, Zihan Chen2026-05-28
🤖 machine learning

SPAR: Support-Preserving Action Rectification

تقدم هذه الورقة البحثية SPAR، وهو إطار عمل لتصحيح الإجراءات مع الحفاظ على الدعم، والذي يحقق أداءً رائدًا في تحسين السياسة غير المتصلة (offline policy improvement) عبر إعادة صياغة التعلم كعملية صقل متبقي محلي لسياسة نسخ السلوك (behavior cloning policy) مجمدة، وتوظيف المحاكاة الذاتية الكامنة لحل الصراع المتأصل بين تعظيم القيمة وملاءمة توزيع البيانات.

Jiaxin Zhao, Weihang Pan, Xun Liang, Binbin Lin2026-05-28
💰 quantitative finance

PortBench: A Correlation-Aware, Full-Pipeline Benchmark for LLM-Driven Portfolio Management

تقدم الورقة البحثية PortBench، وهو معيار شامل يتميز بمجموعة بيانات أسئلة وأجوبة ثابتة ومسار تخصيص ديناميكي مكون من خمس مراحل لتقييم النماذج اللغوية الكبيرة في إدارة المحافظ الاستثمارية، كاشفةً أنه على الرغم من الأداء القوي في الأسئلة المالية الثابتة، فإن معظم النماذج تفشل في التفوق على استراتيجيات التوزان المتساوي الأساسية وتعاني من تراجعات كارثية تحت الضغط بسبب تجاهل هياكل الارتباط وأخطاء الاستدلال التراكمية.

Yuxuan Zhao, Sijia Chen, Ningxin Su2026-05-28