💻 computer science

SSL4RL: Revisiting Self-supervised Learning as Intrinsic Reward for Visual-Language Reasoning

يقدم SSL4RL إطار عمل مبتكر يسخر أهداف التعلم الخاضع للإشراف الذاتي كإشارات مكافأة تلقائية وقابلة للتحقق لضبط نماذج الرؤية واللغة عبر التعلم التعزيزي، مما يتغلب بفعالية على نقص آليات المكافأة القابلة للتوسع ويحسن الأداء بشكل كبير في كل من معايير الاختبار المتمحورة حول الرؤية ومعايير الاستدلال.

Xiaojun Guo, Runyu Zhou, Yifei Wang, Qi Zhang, Chenheng Zhang, Stefanie Jegelka, Xiaohan Wang, Jiajun Chai, Guojun Yin (…)2026-05-19
💬 NLP

Beacon: Single-Turn Diagnosis and Mitigation of Latent Sycophancy in Large Language Models

تقدم الورقة البحثية "Beacon"، وهو معيار اختبار أحادي الدور يعزل ويقيس التملق الكامن في النماذج اللغوية الكبيرة كعلاقة مقايضة بين الصدق والمداهنة، مما يكشف عن انحيازاته الفرعية المعتمدة على القدرة ويمكّن من التدخلات المستهدفة لإعادة محاذاة النماذج مع الدقة الواقعية.

Sanskar Pandey, Ruhaan Chopra, Angkul Puniya, Sohom Pal2026-05-19
🤖 machine learning

Needles in the Landscape: Semi-Supervised Pseudolabeling for Archaeological Site Discovery under Label Scarcity

تقترح هذه الورقة إطار عمل للتعلم شبه الموجه من البيانات الموجبة وغير المصنفة، مع تسمية مستعارة ديناميكية وتحسين باستخدام نماذج الحقول العشوائية المشروطة (CRF)، لاكتشاف المواقع الأثرية بفعالية في المناظر الطبيعية ذات التسميات الشحيحة، محققةً أداءً هو الأفضل حالياً على كل من نماذج الارتفاعات الرقمية وصور الأقمار الصناعية الخام.

Simon Jaxy, Anton Theys, Patrick Willett, W. Chris Carleton, Ralf Vandam, Pieter Libin2026-05-19
💬 NLP

DecoupleSearch: Decouple Planning and Search via Hierarchical Reward Modeling

تقترح هذه الورقة البحثية DecoupleSearch، وهو إطار عمل مبتكر يعزز تقنية RAG الوكيلية (Agentic RAG) من خلال فصل عمليتي التخطيط والبحث عبر نماذج قيمة مزدوجة وبحث شعاعي هرمي لمعالجة تحديات الإشراف على الخطوات وتعقيد فضاء المرشحين.

Hao Sun, Zile Qiao, Bo Wang, Guoxin Chen, Yingyan Hou, Yong Jiang, Pengjun Xie, Fei Huang, Yan Zhang2026-05-19
⚛️ high-energy experiments

Spatially Aware Linear Transformer (SAL-T) for Particle Jet Tagging

تقدم الورقة البحثية "المحول الخطي المدرك مكانيًا" (SAL-T)، وهو بنية مستوحاة من الفيزياء تجمع بين الانتباه الخطي والتقسيم المدرك مكانيًا والطبقات الالتفافية لتحقيق دقة بمستوى المحولات في تصنيف نفاثات الجسيمات مع تقليل التعقيد الحسابي وزمن الاستجراف بشكل كبير.

Aaron Wang, Zihan Zhao, Subash Katel, Vivekanand Gyanchand Sahu, Elham E Khoda, Abhijith Gandrakota, Jennifer Ngadiuba (…)2026-05-19
💬 NLP

Evo-Memory: Benchmarking LLM Agent Test-time Learning with Self-Evolving Memory

تقدم هذه الورقة Evo-Memory، وهو معيار وإطار عمل شامل للبث المصمم لتقييم وتعزيز قدرات الذاكرة ذاتية التطور لوكلاء النماذج اللغوية الكبيرة (LLM) في بيئات المهام المستمرة والديناميكية، والتي تتميز بمسار ReMem المقترح الذي يدمج الاستنتاج، والأفعال، وتحديثات الذاكرة من أجل التحسين المستمر.

Tianxin Wei, Noveen Sachdeva, Benjamin Coleman, Zhankui He, Yuanchen Bei, Xuying Ning, Mengting Ai, Yunzhe Li, Jingrui H (…)2026-05-19
💬 NLP

SignRoundV2: Toward Closing the Performance Gap in Extremely Low-Bit Post-Training Quantization for LLMs

تُعد SignRoundV2 إطار عمل للكمية ما بعد التدريب يستخدم استراتيجية دقة مختلطة تكيفية وتقنيات تثبيت خفيفة الوزن لتقليص الفجوة في الأداء بين النماذج اللغوية الكبيرة المكممة وتلك ذات الدقة الكاملة بشكل كبير، محققةً نتائج تقترب من فقدان البيانات في إعدادات MXFP المختلطة وتحسينات جوهرية في كمية الأوزان فقط عند مستوى 2 بت الصعب.

Wenhua Cheng, Weiwei Zhang, Heng Guo, Haihao Shen, Zaner Ma2026-05-19
💬 NLP

ShareChat: A Dataset of Chatbot Conversations in the Wild

تقدم هذه الورقة البحثية ShareChat، وهي مجموعة بيانات ضخمة متعددة المنصات تضم 142,808 محادثة حقيقية مع روبوتات الدردشة تحافظ على خصائص الواجهة الأصلية عبر 95 لغة لتمكين تقييم أكثر واقعية للنماذج اللغوية الكبيرة بما يتجاوز المعايير الموحدة التي تقتصر على النصوص فقط.

Yueru Yan, Tuc Nguyen, Bo Su, Melissa Lieffers, Thai Le2026-05-19
💬 NLP

Lying with Truths: Open-Channel Multi-Agent Collusion for Belief Manipulation via Generative Montage

تقدم هذه الورقة البحثية "المونتاج التوليدي" (Generative Montage)، وهو هجوم تواطؤ معرفي مبتكر حيث تستغل الوكلاء المستقلون نزعات الاستنتاج لدى النماذج اللغوية الكبيرة للتلاعب بالمعتقدات عبر تركيب سرديات مضللة من أدلة حقيقية متاحة علنًا، مما يكشف أن حتى النماذج المتقدمة معرضة بشدة لمثل هذا التلاعب القائم على الحقيقة.

Jinwei Hu, Xinmiao Huang, Youcheng Sun, Yi Dong, Xiaowei Huang2026-05-19
🤖 machine learning

The Illusion of Specialization: Unveiling the Domain-Invariant "Standing Committee" in Mixture-of-Experts Models

تتحدى هذه الورقة الافتراض السائد بأن نماذج "خليط الخبراء" (Mixture-of-Experts) تحقق التخصص في المجالات من خلال التوجيه المتفرق، وذلك عبر إثبات وجود "لجنة ثابتة" من الخبراء غير متغيرة المجالات تتعامل باستمرار مع غالبية كتلة التوجيه، مما يكشف عن انحياز هيكلي نحو الحوسبة المركزية قد يعيق كفاءة التدريب.

Yan Wang, Yitao Xu, Nanhan Shen, Jinyan Su, Jimin Huang, Zining Zhu2026-05-19