🤖 machine learning

Key-Value Means

تقدم الورقة البحثية "أوساط المفتاح والقيمة" (Key-Value Means - KVM)، وهي آلية تكرار كتلية (block-recurrence) مبتكرة لآلية الانتباه توحد فوائد نماذج المحولات (Transformers) والشبكات العصبية المتكررة الخطية (linear RNNs) من خلال تمكين تدريب فعال قابل للتوازي عبر الكتل مع نمو مرن للحالة ووقت استباقي (prefill time) دون تربيعي، وكل ذلك باستخدام عمليات قياسية وبأقل قدر من المعلمات الإضافية.

Daniel Goldstein, Eugene Cheah2026-05-12✓ Author reviewed
🤖 AI

The Cartesian Shortcut: Re-evaluate Vision Reasoning in Polar Coordinate Space

تقدم هذه الورقة البحثية Polaris-Bench، وهو معيار مرجعي يعيد صياغة مهام الاستدلال البصري في الإحداثيات القطبية للكشف عن ثغرة "الاختصار الكارتيزي" في النماذج اللغوية الكبيرة متعددة الوسائط الحالية، مما يكشف أن أداءها العالي في المعايوهات القياسية القائمة على الشبكات ينبع من استغلال أنماط الإحداثيات النصية بدلاً من الفهم البصري القوي والمستقل عن الطوبولوجيا.

Xia Hu, Zhenrui Yue, Brian Potetz, Howard Zhou, Leonidas Guibas, Chun-Ta Lu, Zhicheng Wang2026-05-12
🤖 machine learning

The Geometric Wall: Manifold Structure Predicts Layerwise Sparse Autoencoder Scaling Laws

تُثبت هذه الورقة أن قوانين القياس للمشفرات التلقائية المتناثرة عبر طبقات الشبكة العصبية ليست عالمية، بل يتم تحديدها بدلاً من ذلك من خلال البنية الهندسية الكامنة لمنطوِق التنشيط، وتحديداً انحنائه وأبعاده الجوهرية، والتي تملي بشكل يمكن التنبؤ به مستويات خطأ إعادة البناء وأُسس العرض بطريقة قابلة للنقل عبر النماذج المختلفة.

Eslam Zaher, Maciej Trzaskowski, Quan Nguyen, Fred Roosta2026-05-12
🤖 AI

Pseudo-Deliberation in Language Models: When Reasoning Fails to Align Values and Actions

تقدم هذه الورقة مفهوم "التداول الزائف" لوصف عدم الاتساق المستمر بين القيم المعلنة للنماذج اللغوية الكبيرة وأفعالها الفعلية حتى في حالة وجود عملية استدلال، وتقترح إطار عمل VALDI ونظام التدخل VIVALDI لقياس ومعالجة فجوة القيمة والعمل هذه بشكل منهجي.

Sushrita Rakshit, Hanwen Zhang, Hua Shen2026-05-12
🤖 AI

Hyperbolic Distillation: Geometry-Guided Cross-Modal Transfer for Robust 3D Object Detection

تقترح هذه الورقة البحثية إطار عمل HGC-Det، وهو إطار للتقطير عبر الوسائط موجه بالهندسة الزائدية يدمج ميزات الصور والسحب النقطية من خلال تحسين الفوكسل الموجه دلاليًا، ونقل الميزات المقيد بالهندسة الزائدية، والتجميع القائم على الهندسة لتحقيق كشف قوي للأجسام ثلاثية الأبعاد مع تحسين التوازن بين الدقة والتكلفة عبر مجموعات بيانات متنوعة داخلية وخارجية.

Kanglin Ning, Wenrui Li, Houde Quan, Qifan Li, Xingtao Wang, Xiaopeng Fan2026-05-12
🤖 AI

The Gordian Knot for VLMs: Diagrammatic Knot Reasoning as a Hard Benchmark

يقدم KnotBench معياراً مرجعياً صارماً باستخدام ما يقرب من 860,000 مخطط للعقد لتوضيح أن النماذج اللغوية الرؤية الحالية، على الرغم من تحسن أدائها مع أوضاع "التفكير"، تعاني بشكل أساسي من صعوبة في ترجمة هياكل العقد البصرية إلى استدلال رمزي قابل للتنفيذ، وغالباً ما تفشل في التفوق على الخطوط المرجعية العشوائية في المهام التي تتطلب معالجة تخطيطية.

Hao Liu, Jicheng Liu2026-05-12
🤖 AI

Separate First, Fuse Later: Mitigating Cross-Modal Interference in Audio-Visual LLMs Reasoning with Modality-Specific Chain-of-Thought

تقترح الورقة البحثية إطار عمل "الفصل أولاً، ثم الدمج لاحقاً" (SFFL)، وهو إطار عمل جديد للاستدلال السمعي البصري يخفف من التداخل بين الوسائط والهلوسة في النماذج اللغوية الكبيرة السمعية البصرية من خلال فرض استدلال تسلسلي خاص بكل وسيط يليه دمج للأدلة، مما يؤدي إلى تحسينات كبيرة في الدقة والمتانة في معايير تقييم الأسئلة والأجوبة السمعية البصرية.

Xuanchen Li, Yuheng Lu, Chenrui Cui, Tianrui Wang, Zikang Huang, Yu Jiang, Long Zhou, Longbiao Wang, Jianwu Dang2026-05-12
🤖 AI

RADAR: Redundancy-Aware Diffusion for Multi-Agent Communication Structure Generation

إنَّ RADAR هو إطار عمل توليدي يعتمد على الاستعلام ويدرك التكرار، يستخدم الانتشار الرسومي المتقطع المشروط لتحسين طوبولوجيا الاتصال متعدد الوكلاء ديناميكيًا، مما يحقق دقة أعلى، واستهلاكًا أقل للرموز، ومتانة أكبر مقارنة بالطرق الحالية.

Zhen Zhang, Wanjing Zhou, Juncheng Li, Hao Fei, Jun Wen, Wei Ji2026-05-12
🤖 AI

Position: Academic Conferences are Potentially Facing Denominator Gaming Caused by Fully Automated Scientific Agents

تحذر هذه الورقة الموقفية من أن مؤتمرات الذكاء الاصطناي التنافسية الكبرى تواجه ثغرة نظامية تسمى "التلاعب بالمنظومة عبر الوكلاء" (Agentic Denominator Gaming)، حيث يستخدم الفاعلون الخبثاء وكلاءً آليين لإغراق مجمعات التقديم بأوراق بحثية منخفضة الجودة لرفع معدلات القبول للأعمال المشروعة المستهدفة بشكل مصطنع، مما يستلد إصلاحات هيكلية في السياسات بدلاً من مجرد الاكتفاء بالرصد التقني للتخفيف من حدة احتراق المراجعين وتدهور جودة المراجعة الناتج عن ذلك.

Rong Shan, Te Gao, Hang Zheng, Yunjia Xi, Jiachen Zhu, Zeyu Zheng, Yong Yu, Weinan Zhang, Jianghao Lin2026-05-12
🤖 machine learning

NaiAD: Initiate Data-Driven Research for LLM Advertising

تقدم الورقة البحثية NaiAD، وهي أول مجموعة بيانات شاملة للإعلانات الأصلية في النماذج اللغوية الكبيرة (LLM-native advertising) تضم ما يقرب من 59,000 استجابة مدمجة بالإعلانات وخط إنتاج توليدي منفصل، مما يمكّن النماذج من تحسين تجربة المستخدم والإيرادات التجارية في آن واحد من خلال استراتيجيات دلالية متميزة وتعلم سياقي قابل للتحكم.

Yihang Zhang, Zimeng Huang, Ren Zhai, Yipeng Kang, Tonghan Wang2026-05-12