🤖 AI

GRIT: Teaching MLLMs to Think with Images

تقترح الورقة البحثية طريقة GRIT، وهي طريقة قائمة على التعلم المعزز تُمكّن النماذج اللغوية الكبيرة متعددة الوسائط من توليد سلاسل استدلال مرتكزة بصرياً عبر دمج اللغة الطبيعية مع إحداثيات صناديق الإحاطة الصريحة، مما يحقق كفاءة عالية في البيانات دون الحاجة إلى تسميات توضيحية للاستدلال أو التحديد الموضعي.

Yue Fan, Xuehai He, Diji Yang, Kaizhi Zheng, Ching-Chen Kuo, Yuting Zheng, Sravana Jyothi Narayanaraju, Xinze Guan, Xin (…)2026-05-12
🤖 machine learning

Beyond Multiple Choice: Evaluating Steering Vectors for Summarization

تقيم هذه الورقة ناقلات التوجيه للتحكم في خصائص مثل المشاعر والسمية في التلخيص التجريدي، حيث وجدت أنه بينما توفر تحكماً فعالاً، إلا أنها تسبب مخرجات متدهورة عند القوة العالية، مما يجعل النهج الهجين مع التلقين هو الاستراتيجية الأكثر فعالية لتحقيق التوازن بين التحكم والجودة.

Joschka Braun, Carsten Eickhoff, Seyed Ali Bahrainian2026-05-12
🤖 AI

Overcoming Multi-step Complexity in Multimodal Theory-of-Mind Reasoning: A Scalable Bayesian Planner

تقترح هذه الورقة مخطط نظرية عقل بايزي (Bayesian Theory-of-Mind) قابلاً للتوسع، يستفيد من التحكم من الضعيف إلى القوي لتمكين النماذج اللغوية الأصغر من توجيه النماذج الأكبر في تفكيك الاستدلال متعدد الوسائط المعقد إلى تحديثات بايزية خطوة بخطوة، محققةً دقة هي الأفضل في حالتها في استنتاج الحالات الذهنية البشرية.

Chunhui Zhang, Zhongyu Ouyang, Kwonjoon Lee, Nakul Agarwal, Sean Dae Houlihan, Soroush Vosoughi, Shao-Yuan Lo2026-05-12
🤖 AI

Elite Polarization in European Parliamentary Speeches: a Novel Measurement Approach Using Large Language Models

تقدم هذه الورقة "درجة استقطاب النخبة"، وهي نهج قياس مبتكر وقابل للتوسع باستخدام النماذج اللغوية الكبيرة لتقدير التقييمات المتبادلة العدائية بين النخب السياسية في الخطابات البرلمانية، مما يثبت صلاحيتها وتميزها عن المقاييس الحالية عبر المملكة المتحدة والمجر وإيطاليا.

Gennadii Iakovlev2026-05-12
💬 NLP

K4K^4: Online Log Anomaly Detection Via Unsupervised Typicality Learning

تقدم الورقة البحثية K4K^4، وهو إطار عمل غير مُشرف وغير معتمد على محلل لغوي، يحقق أداءً فائقاً في كشف شذوذ السجلات عبر الإنترنت من خلال تحويل تضمينات السجلات إلى واصفات مدمجة رباعية الأبعاد مشتقة من إحصائيات أقرب kk جار، وذلك بسرعة ودقة استثنائيتين.

Weicong Chen, Vikash Singh, Zahra Rahmani, Debargha Ganguly, Mohsen Hariri, Vipin Chaudhary2026-05-12
⚡ electrical engineering

MECAT: A Multi-Experts Constructed Benchmark for Fine-Grained Audio Understanding Tasks

تقدم هذه الورقة البحثية MECAT، وهو معيار مرجعي مبني على تعدد الخبراء يتميز بتعليقات توضيحية دقيقة وأزواج أسئلة وأجوبة مفتوحة المجموعة تم إنشاؤها عبر مسار متخصص، إلى جانب مقياس DATE المبتكر المصمم لتقييم ومكافأة الأوصاف الصوتية التفصيلية على حساب الأوصاف العامة، وذلك لتقييم قدرات الفهم الدقيقة لنماذج اللغة والصوت الكبيرة بشكل أفضل.

Yadong Niu, Tianzi Wang, Heinrich Dinkel, Xingwei Sun, Jiahao Zhou, Gang Li, Jizhong Liu, Xunying Liu, Junbo Zhang, Jian (…)2026-05-12
💬 NLP

Majority Bit-Aware Watermarking For Large Language Models

تقدم هذه الورقة البحثية "العلامة المائية الواعية ببت الأغلبية" (Majority Bit-Aware Watermarking)، وهي نموذج ترميز مبتكر بإنتاجيْن (MajorMark و MajorMark+^{+}) يحل المقايضة بين جودة النص ودقة فك التشفير في العلامات المائية للنماذج اللغوية الكبيرة عبر الحفاظ على إشارات علامة مائية قوية حتى مع وجود قوائم خضراء كبيرة.

Jiahao Xu, Rui Hu, Olivera Kotevska, Zikai Zhang2026-05-12
💻 computer science

SSA: Improving Performance With a Better Scoring Function

تقترح هذه الورقة البحثية "المتوسط الإشاري المقيّس" (SSA)، وهي دالة تسجيل انتباه مبتكرة تحل محل "Softmax" لمعالجة إخفاقات التعميم تحت تغير التوزيع في التعلم داخل السياق، مما يظهر تحسينات كبيرة في الأداء عبر مختلف معايير معالجة اللغات الطبيعية والبنيات الهيكلية.

Omar Naim, Swarnadeep Bhar, Jérôme Bolte, Nicholas Asher2026-05-12
🤖 AI

GUARD: Guideline Upholding Test through Adaptive Role-play and Jailbreak Diagnostics for LLMs

تقدم الورقة البحثية GUARD، وهو إطار عمل للاختبار يعمل على تحويل المبادئ التوجيهية الأخلاقية الحكومية رفيعة المستوى إلى أسئلة قابلة للتنفيذ ويدمج تشخيصات كسر الحماية (jailbreak) لتقييم والتقرير بشكل منهجي عن الامتثال ومتانة السلامة للنماذج اللغوية الكبيرة والنماذج اللغوية البصرية.

Haibo Jin, Ruoxi Chen, Peiyan Zhang, Andy Zhou, Zelei Cheng, Haohan Wang2026-05-12
📊 statistics

Top-H Decoding: Adapting the Creativity and Coherence with Bounded Entropy in Text Generation

تقدم هذه الورقة البحثية "Top-H decoding"، وهي خوارزمية أخذ عينات مبتكرة تعتمد على إطار عمل لتعظيم الكتلة المقيد بالإنتروبيا، توازن بفعالية بين الإبداع والتماسك في النماذج اللغوية الكبيرة، متفوقةً بذلك على الأساليب الرائدة مثل "min-p sampling" في اختبارات الكتابة الإبداعية مع الحفاظ على المتانة في المهام الواقعية.

Erfan Baghaei Potraghloo, Seyedarmin Azizi, Souvik Kundu, Massoud Pedram2026-05-12