📊 statistics

Tippett-minimum Fusion of Representation-space Diffusion Models for Multi-Encoder Out-of-Distribution Detection

تقدم الورقة البحثية EncMin2L، وهو إطار عمل فعال من حيث المعلمات ومستقل عن المشفر، يدمج نماذج الانتشار في فضاء التمثيل عبر بوابة حد أدنى إحصائية ثنائية المستوى لتحقيق كشف قوي للبيانات خارج التوزيع عبر أنواع مختلفة من الإزاحة دون الحاجة إلى تسميات البيانات خارج التوزيع.

Neelkamal Bhuyan2026-05-21
🤖 machine learning

Reinforcing Human Behavior Simulation via Verbal Feedback

تقدم هذه الورقة نموذج DITTO، وهو نموذج تم تدريبه عبر التعلم التعزيزي باستخدام التغذية الراجعة اللفظية لمحاكاة السلوك البشري بشكل أفضل، إلى جانب مجموعة اختبار SOUL، مما يظهر تحسينات كبيرة في الأداء مقارنة بالنماذج الأساسية وتفوقاً على GPT-5.4 في مهام محاكاة متعددة شبيهة بالبشر.

Weiwei Sun, Xuhui Zhou, Jiarui Liu, Weihua Du, Haojia Sun, Yiqing Xie, Qianou Ma, Sihao Chen, Mengting Wan, Longqi Yang (…)2026-05-21
⚡ electrical engineering

NeuroQA: A Large-Scale Image-Grounded Benchmark for 3D Brain MRI Understanding

تُعد NeuroQA معياراً مرجعياً واسع النطاق ومبنياً على الصور، يضم ما يقرب من 57,000 زوج من الأسئلة والأجوبة المستمدة من أحجام الرنين المغناطيسي ثلاثية الأبعاد للدماغ عبر 12 مجموعة بيانات وخمسة مجالات سريرية، وهو مصمم لتقييم الاستدلال البصري الطبي ثلاثي الأبعاد بصرامة مع القضاء على الاختصارات النصية فقط من خلال بروتوكولات التأسيس الصارم على الصور والتحقق من قبل الخبراء.

Mohammad H. Abbasi (Stanford University), Favour Nerrise (Stanford University), Shaurnav Ghosh (Stanford University), Ri (…)2026-05-21
💻 computer science

Pseudo-Formalization for Automatic Proof Verification

تقدم هذه الورقة "الصورية الزائفة" (Pseudo-Formalization)، وهي تنسيق برهان هجين يجمع بين مرونة اللغة الطبيعية والنمطية الصورية، وخوارزمية "التحقق بالكتل" (Block Verification) المقابلة لها والتي تتفوق بشكل كبير على النماذج المرجعية الحالية لـ "النماذج اللغوية الكبيرة كحكم" (LLM-as-judge) في التحقق بدقة من البراهن الرياضية عبر اختبارات مستوى الأولمبياد والمستوى البحثي.

Slim Barkallah, Luke Bailey, Kaiyue Wen, Mohammed Abouzaid, Tengyu Ma2026-05-21
🤖 machine learning

OpenSeisML: Open Large-Scale Real Seismic and well-log Dataset for Generative AI

تقدم هذه الورقة OpenSeisML، وهي مجموعة منسقة من مجموعات بيانات زلزالية وسجلات آبار حقيقية من مستودع البيانات الوطني البريطاني، وتتميز بمسار مؤتمت للتحويل من الزمن إلى العمق، وذلك لمعاللة ندرة البيانات العامة وتمكين تدريب نماذج الذكاء الاصطنا التوليدي لقلب البيانات الزلزالية وتقدير عدم اليقين.

Ipsita Bhar, Huseyin Tuna Erdinc, Thales Souza, Charles Jones, Felix J. Herrmann2026-05-21
📊 statistics

Sample Complexity of Transfer Learning: An Optimal Transport Approach

تثبت هذه الورقة نظرياً أن التعلم بنقل المعرفة يحقق كفاءة عينة متفوقة مقارنة بالتعلم المباشر في الإعدادات عالية الأبعاد (d>3d > 3) من خلال الاستفادة من إطار عمل النقل الأمثل، مما يفيد بشكل خاص المهام التي تتضمن نماذج معقدة وغير سلسة، وهو اكتشاف تم التحقق منه عددياً من خلال تجارب تصنيف الصور.

Haoyang Cao, Xin Guo, Wenpin Tang, Guan Wang2026-05-21
📊 statistics

Latent Process Generator Matching

تقدم هذه الورقة "مطابقة مولد العمليات الكامنة" (Latent Process Generator Matching)، وهو إطار عمل عام ينمذج حالات التوليد المرصودة كإسقاطات حتمية لعمليات ماركوف قابلة للتحكم، مما يوسع نطاق "مطابقة المولد" (Generator Matching) من المتغيرات الكامنة الساكنة إلى العمليات الشرطية الكامنة المعتمدة على الزمن مع ضمان مطابقة المولد المتعلم للتوزيعات الهامشية المستهدفة.

Lukas Billera, Hedwig Nora Nordlinder, Ben Murrell2026-05-21
📊 statistics

Spectral bandits for smooth graph functions with applications in recommender systems

تقدم هذه الورقة مفهوم "المندوبات الطيفية" (spectral bandits) للدوال الرسومية الناعمة، مقترحةً خوارزميتين فعالتين تستفيدان من بُعدٍ فعالٍ صغير لتقليل الندم التراكمي في مشكلات التعلم عبر الإنترنت مثل التوصيات القائمة على المحتوى، حيث تكون تقييمات العناصر مشابهة لجيرانها في رسم بياني.

Tomáš Kocák, Michal Valko, Rémi Munos, Branislav Kveton, Shipra Agrawal2026-05-21
🤖 machine learning

Complementing reinforcement learning with SFT through logit averaging in the post training of LLMs

تقدم هذه الورقة طريقة جديدة لما بعد التدريب للنماذج اللغوية الكبيرة تعزز تحسين السياسة النسبية للمجموعات (GRPO) عن طريق متوسط "اللوجيتس" لسياسة مرجعية للضبط الدقيق الموجه (SFT) مجمدة وسياسة قابلة للتدريب، مما يلغي الحاجة إلى تنظيم "KL" أو وجود "ناقد" مع الجمع بفعالية بين قدرات الاستدلال للتعلم التعزيزي واستقرار التنسيق للضبط الدقيق الموجه.

Xingwei Gan, Ying Zhu2026-05-21
📊 statistics

Group-Aware Matrix Estimation and Latent Subspace Recovery

تقدم هذه الورقة البحثية تقدير المصفوفة الواعي بالمجموعات (GAME)، وهو مُقدِّر محدب يستخدم عقوبات النواة النووية المتداخلة لاستعادة الهياكل الكامنة الخاصة بالمجموعات الفرعية في مشكلات إكمال المصفوفات غير المتجانسة، مما يظهر دقة إعادة بناء وأمانة في الفضاء الجزئي متفوقة على الطرق القياسية، لا سيما في سيناريوهات الفقدان المهيكل والتباينات منخفضة الرتبة المتميزة للمجموعات.

Hamza Golubovic, Matthew Shen, Genevera I. Allen, Tarek M. Zikry2026-05-21