🤖 AI

Exploitation Without Deception: Dark Triad Feature Steering Reveals Separable Antisocial Circuits in Language Models

تُظهر هذه الدراسة أن استخدام توجيه ميزات المشفر التلقائي المتناثر لتضخيم سمات "الثالوث المظلم" في نموذج Llama-3.3-70B-Instruct يزيد بشكل انتقائي من السلوكيات الاستغلالية والقاسية مع ترك الخداع الاستراتيجي والتعاطف المعرفي دون تغيير، مما يكشف أن النزعات المعادية للمجتمع في النماذج اللغوية الكبيرة تتكون من مسارات حوسبية منفصلة بدلاً من كونها بنية موحدة.

Cameron Berg, Roshni Lulla2026-05-12
🤖 AI

EvoPref: Multi-Objective Evolutionary Optimization Discovers Diverse LLM Alignments Beyond Gradient Descent

يقدم EvoPref خوارزمية تطورية متعددة الأهداف باستخدام NSGA-II ومهايئات LoRA للتغلب على انهيار التفضيل في الطرق القائمة على التدرج، محققاً تنوعاً أكبر بكثير في محاذاة النماذج اللغوية الكبيرة مع الحفاظ على جودة تنافسية في المعايك القياسية.

Dongxin Guo, Jikun Wu, Siu Ming Yiu2026-05-12
🤖 AI

Parameter-Efficient Neuroevolution for Diverse LLM Generation: Quality-Diversity Optimization via Prompt Embedding Evolution

تقدم الورقة البحثية QD-LLM، وهو إطار عمل للتطور العصبي فعال في المعلمات يقوم بتطوير تضمينات مطالبات مدمجة ضمن مخطط تحسين التنوع والجودة لتوجيه النماذج اللغوية الكبيرة المجمدة نحو مخرجات متنوعة وعالية الجودة، متفوقاً بشكل كبير على الأساليب الحالية في التغطية والمنفعة في المهام اللاحقة دون الحاجة إلى ضبط دقيق للنموذج.

Dongxin Guo, Jikun Wu, Siu Ming Yiu2026-05-12
🤖 AI

The Metacognitive Probe: Five Behavioural Calibration Diagnostics for LLMs

تقدم الورقة البحثية "المسبار الميتا-معرفي" (Metacognitive Probe)، وهو أداة تشخيصية مكونة من خمس مهام تقيم سلوكيات الثقة لدى النماذج اللغوية الكبيرة عبر خمسة أبعاد متميزة للكشف عن جيوب خفية من الثقة المفرطة التي تغفل عنها الاختبارات القياسية التجميعية، مما يظهر تباينًا كبيرًا قدره 47 نقطة بين معايرة النموذج الخاصة بمهمة معينة وقدراته على التنبؤ بصعوبة المهام عبر مختلف المهام.

Rafael C. T. Oliveira2026-05-12
🤖 AI

EgoMemReason: A Memory-Driven Reasoning Benchmark for Long-Horizon Egocentric Video Understanding

تقدم هذه الورقة EgoMemReason، وهو معيار شامل مصمم لتقييم فهم الفيديو من منظور الشخص الأول (egocentric) طويل المدى عبر اختبار الاستدلال القائم على الذاكرة عبر أنواع الكيانات والأحداث والسلوكيات، مما يكشف أن النماذج متعددة الوسائط الحالية تعاني بشكل كبير في دمج الأدلة المتفرقة عبر فترات زمنية تمتد لعدة أيام.

Ziyang Wang, Yue Zhang, Shoubin Yu, Ce Zhang, Zengqi Zhao, Jaehong Yoon, Hyunji Lee, Gedas Bertasius, Mohit Bansal2026-05-12
🤖 machine learning

Key-Value Means

تقدم الورقة البحثية "أوساط المفتاح والقيمة" (Key-Value Means - KVM)، وهي آلية تكرار كتلية (block-recurrence) مبتكرة لآلية الانتباه توحد فوائد نماذج المحولات (Transformers) والشبكات العصبية المتكررة الخطية (linear RNNs) من خلال تمكين تدريب فعال قابل للتوازي عبر الكتل مع نمو مرن للحالة ووقت استباقي (prefill time) دون تربيعي، وكل ذلك باستخدام عمليات قياسية وبأقل قدر من المعلمات الإضافية.

Daniel Goldstein, Eugene Cheah2026-05-12✓ Author reviewed
🤖 AI

Pseudo-Deliberation in Language Models: When Reasoning Fails to Align Values and Actions

تقدم هذه الورقة مفهوم "التداول الزائف" لوصف عدم الاتساق المستمر بين القيم المعلنة للنماذج اللغوية الكبيرة وأفعالها الفعلية حتى في حالة وجود عملية استدلال، وتقترح إطار عمل VALDI ونظام التدخل VIVALDI لقياس ومعالجة فجوة القيمة والعمل هذه بشكل منهجي.

Sushrita Rakshit, Hanwen Zhang, Hua Shen2026-05-12
🤖 AI

The Gordian Knot for VLMs: Diagrammatic Knot Reasoning as a Hard Benchmark

يقدم KnotBench معياراً مرجعياً صارماً باستخدام ما يقرب من 860,000 مخطط للعقد لتوضيح أن النماذج اللغوية الرؤية الحالية، على الرغم من تحسن أدائها مع أوضاع "التفكير"، تعاني بشكل أساسي من صعوبة في ترجمة هياكل العقد البصرية إلى استدلال رمزي قابل للتنفيذ، وغالباً ما تفشل في التفوق على الخطوط المرجعية العشوائية في المهام التي تتطلب معالجة تخطيطية.

Hao Liu, Jicheng Liu2026-05-12
🤖 AI

Position: Academic Conferences are Potentially Facing Denominator Gaming Caused by Fully Automated Scientific Agents

تحذر هذه الورقة الموقفية من أن مؤتمرات الذكاء الاصطناي التنافسية الكبرى تواجه ثغرة نظامية تسمى "التلاعب بالمنظومة عبر الوكلاء" (Agentic Denominator Gaming)، حيث يستخدم الفاعلون الخبثاء وكلاءً آليين لإغراق مجمعات التقديم بأوراق بحثية منخفضة الجودة لرفع معدلات القبول للأعمال المشروعة المستهدفة بشكل مصطنع، مما يستلد إصلاحات هيكلية في السياسات بدلاً من مجرد الاكتفاء بالرصد التقني للتخفيف من حدة احتراق المراجعين وتدهور جودة المراجعة الناتج عن ذلك.

Rong Shan, Te Gao, Hang Zheng, Yunjia Xi, Jiachen Zhu, Zeyu Zheng, Yong Yu, Weinan Zhang, Jianghao Lin2026-05-12
🤖 AI

Team-Based Self-Play With Dual Adaptive Weighting for Fine-Tuning LLMs

تقدم هذه الورقة البحثية "اللعب الذاتي القائم على الفريق مع التوزين التكيفي المزدوج" (TPAW)، وهو خوارزمية تعلم ذاتي مبتكرة تعزز محاذاة النماذج اللغوية الكبيرة من خلال استخدام إطار عمل فريق تعاوني-تنافسي مع نقاط تفتيش تاريخية وآليات توزين تكيفي مزدوج للتغلب على عدم الاستقرار والقيود التحسينية لأساليب التدريب الذاتي الحالية.

Wu Li, Yigeng Zhou, Zesheng Shi, Yequan Wang, Min Zhang, Jing Li2026-05-12