🤖 machine learning

Precise Verification of Transformers through ReLU-Catalyzed Abstraction Refinement

تقترح هذه الورقة إطار عمل جديد للتحقق من نماذج المحولات (transformer) يعزز الدقة عبر الاستفادة من تجريدات قائمة على دالة ReLU لتحديد حدود نواتج الضرب النقطي في طبقات الانتباه الذاتي بدقة، مما يقلل بشكل كبير من الإنذارات الكاذبة مقارنة بطرق التقريب المحدب الحالية مع الحفاظ على كفاءة مقبولة.

Hengjie Liu, Zhenya Zhang, Jianjun Zhao2026-05-15
📊 statistics

Policy Optimization in Hybrid Discrete-Continuous Action Spaces via Mixed Gradients

تقترح هذه الورقة البحثية "تحسين السياسة الهجين" (HPO)، وهي طريقة جديدة للتعلم التعزيزي تجمع بين تدرجات المسار وتدرجات دالة الدرجة لتمكين التدريب غير المنحاز والفعال في فضاءات العمل الهجينة المتقطعة والمستمرة، مما يتفوق بشكل كبير على النهج القياسية مثل (PPO) في مشكلات التحكم عالي الأبعاد ومشكلات المخزون.

Matias Alvo, Daniel Russo, Yash Kanoria2026-05-15
🤖 machine learning

Matrix-Space Reinforcement Learning for Reusing Local Transition Geometry

تقدم هذه الورقة البحثية "التعلم المعزز في فضاء المصفوفات" (MSRL)، وهو إطار هندسي يمثل قطع مسارات الحركة عبر واصفات مصفوفة موجبة محددة شبه، لتمكين التركيب الجبري ونقل الهندسة الانتقالية المحلية، مما يحقق كفاءة عينة فائقة وأداءً متفوقاً في التعميم التركيبي مقارنة بالطرق القائمة.

Zuyuan Zhang, Carlee Joe-Wong, Tian Lan2026-05-15
🤖 machine learning

Beyond Binary: Reframing GUI Critique as Continuous Semantic Alignment

تقدم هذه الورقة البحثية BBCritic، وهو نموذج جديد يعيد صياغة نقد واجهات المستخدم الرسومية (GUI) كمسألة محاذاة دلالية مستمرة بدلاً من التصنيف الثنائي، مستفيداً من التعلم التبايني للتغلب على قيود النماذج الحالية وتحقيق أداء تصنيف متفوق دون الحاجة إلى تعليقات توضيحية إضافية.

Yuchen Sun, Pei Fu, Shaojie Zhang, Anan Du, Xiuwen Xi, Ruoceng Zhang, Zhenbo Luo, Jian Luan, Chongyang Zhang2026-05-15
🤖 machine learning

AIM-DDI: A Model-Agnostic Multimodal Integration Module for Drug-Drug Interaction Prediction

تقدم الورقة البحثية AIM-DDI، وهو وحدة دمج متعددة الوسائط غير مرتبطة بنموذج محدد، تقوم بتمثيل معلومات الأدوية غير المتجانسة كرموز (tokens) في فضاء كامن مشترك لتعزيز التنبؤ بالتفاعلات الدوائية-الدوائية بشكل فعال، لا سيالما بالنسبة للأدوية غير المرئية، عبر بنيات معمارية متنوعة.

Yerin Park, Sangseon Lee2026-05-15
💻 computer science

CrystalReasoner: Reasoning and RL for Property-Conditioned Crystal Structure Generation

إن CrystalReasoner هو إطار عمل لنماذج اللغات الكبيرة (LLM) متكامل الأطراف، يقوم بتوليد هياكل بلورية صالحة ومستقرة ومشروطة بخصائص معينة من خلال دمج الأولويات الفيزيائية كرموز تفكير (thinking tokens) وتوظيف التعلم المعزز متعدد الأهداف لمواءمة التعليمات المكتوبة باللغة الطبيعية مع الإحداثيات الذرية ثلاثية الأبعاد.

Yuyang Wu, Stefano Falletta, Delia McGrath, Sherry Yang2026-05-15
💬 NLP

Herculean: An Agentic Benchmark for Financial Intelligence

تقدم الورقة البحثية "Herculean"، وهو أول معيار وكيل للذكاء المالي يقيم الوكلاء الاصطناعيين عبر أربعة تدفقات عمل معقدة (التداول، والتحوط، ورؤى السوق، والتدقيق) باستخدام بيئات معيارية قائمة على بروتوكول (MCP)، كاشفةً أنه في حين يؤدي الوكلاء بشكل جيد في التداول والرؤى، فإنهم يواجهون صعوبة كبيرة في التنسيق طويل الأمد والتحقق المنظم المطلوب لعمليات التحوط والتدقيق.

Xueqing Peng, Zhuohan Xie, Yupeng Cao, Haohang Li, Lingfei Qian, Yan Wang, Vincent Jim Zhang, Huan He, Xuguang Ai, Linha (…)2026-05-15
🤖 machine learning

Uncovering the Representation Geometry of Minimal Cores in Overcomplete Reasoning Traces

تقدم هذه الورقة مفهوم "الأنوية الدنيا" (minimal cores) لتوضيح أن مسارات الاستدلال في النماذج اللغوية مفرطة في الاكتمال بشكل كبير، مما يكشف أن مجموعة فرعية صغيرة من الخطوات تحافظ على دقة التنبؤ مع تقديم تمثيل هندسي أنظف وأقل أبعاداً لعملية الاستدلال الكامنة.

Sanjoy Chowdhury, Dinesh Manocha2026-05-15
🤖 machine learning

LoMETab: Beyond Rank-1 Ensembles for Tabular Deep Learning

تقدم الورقة البحثية LoMETab، وهو تعميم من الرتبة rr للمجموعات الضمنية الضربيه التي توسع فئة الفرضيات لـ BatchEnsemble وتوفر تنوعاً قابلاً للتحكم من خلال رتبة المهايئ ومقياس التهيئة، مما يوفر إطاراً مرناً لتحسين أداء التعلم العميق للبيانات الجدولية بما يتجاوز البناءات ثابتة الرتبة-1.

Changryeol Choi, Hyewon Park, Yujin Kwon, Gowun Jeong2026-05-15
💬 NLP

Where Should Diffusion Enter a Language Model? Geometry-Guided Hidden-State Replacement

تقدم الورقة البحثية نموذج DiHAL، وهو نموذج هجين موجه هندسياً يعمل على تحسين نماذج اللغة الانتشارية المستمرة من خلال تحديد الطبقات المثلى ضمن نماذج المحولات مسبقة التدريب لاستبدالها بجسر انتشار لإعادة بناء الحالة الخفية، مما يتجنب الاسترداد المباشر للرموز من المستمر إلى المتقطع ويحقق أداءً فائقاً.

Injin Kong, Hyoungjoon Lee, Yohan Jo2026-05-15