🤖 AI

Diagnosing the Reliability of LLM-as-a-Judge via Item Response Theory

تقدم هذه الورقة إطاراً تشخيصياً ذا مرحلتين يرتكز على نموذج الاستجابة المتدرجة ضمن نظرية الاستجابة للمفردة، وذلك لتقييم موثوقية استخدام النماذج اللغوية الكبيرة كحَكَم بشكل منهجي، عبر تقييم اتساقها الجوهري تحت متغيرات الأوامر البرمجية ومدى توافقها مع تقييمات الجودة البشرية.

Junhyuk Choi, Sohhyung Park, Chanhee Cho, Hyeonchu Park, Bugeun Kim2026-06-01
📊 statistics

An Odd Estimator for Shapley Values

تقدم هذه الورقة البحثية OddSHAP، وهو مُقدِّر جديد لقيمة شابلي (Shapley value) يحقق دقة هي الأفضل في فئته من خلال الإثبات النظري بأن أخذ العينات المزدوج يستبعد المكونات الزوجية غير ذات الصلة من دالة المجموعة، مما يتيح إجراء انحدار متعدد الحدود بكفاءة على الفضاء الجزئي الفردي فقط.

Fabian Fumagalli, Landon Butler, Justin Singh Kang, Kannan Ramchandran, R. Teal Witter2026-06-01
🤖 AI

Plain Transformers are Surprisingly Powerful Link Predictors

تقدم الورقة البحثية PENCIL، وهو نموذج Transformer بسيط يعتمد فقط على المشفر (encoder-only)، يتميز بالقابلية للتوسع وكفاءة المعلمات، حيث يستفيد من آلية الانتباه عبر الرسوم البيانية الفرعية المحلية التي يتم أخذ عينات منها ليتفوق على الشبكات العصبية الرسومية المعقدة والنهج القائمة على الاستدلال في التنبؤ بالروابط دون الاعتماد على ميزات العقد أو الأولويات الهيكلية المصممة يدويًا.

Quang Truong, Yu Song, Donald Loveland, Mingxuan Ju, Tong Zhao, Neil Shah, Jiliang Tang2026-06-01
🤖 AI

Mixture of Concept Bottleneck Experts

تقترح الورقة البحثية إطار عمل "خليط من خبراء عنق الزجاجة للمفاهيم" (M-CBE)، وهو إطار يعزز نماذج عنق الزجاجة للمفاهيم عبر توظيف خبراء متعددين ذوي أشكال وظيفية متنوعة لتحسين دقة التنبؤ والقدرة على التكيف مع الحفاظ على القابلية للتفسير.

Francesco De Santis, Gabriele Ciravegna, Giovanni De Felice, Arianna Casanova, Francesco Giannini, Michelangelo Diligent (…)2026-06-01
💬 NLP

Stop the Flip-Flop: Context-Preserving Verification for Fast Revocable Diffusion Decoding

تقدم هذه الورقة COVER، وهي طريقة تحقق حافظة للسياق تقضي على تذبذبات الـ flip-flop في فك التشفير الانتشاري سريع الإلغاء من خلال استخدام تجاوزات ذاكرة التخزين المؤقت لـ KV وآلية تسجيل تعتمد على الاستقرار لتمكين توليد الرموز المتوازي عالي الجودة والكفء.

Yanzheng Xiang, Lan Wei, Yizhen Yao, Qinglin Zhu, Hanqi Yan, Chen Jin, Philip Alexander Teare, Dandan Zhang, Lin Gui, Am (…)2026-06-01
💬 NLP

A Behavioural and Representational Evaluation of Goal-Directedness in Language Model Agents

تقترح هذه الورقة إطار عمل يجمع بين الاختبار السلوكي وتحليل القابلية للتفسير لتقييم التوجه نحو الأهداف في وكلاء النماذج اللغوية، مبرهنةً من خلال دراسة حالة في عالم الشبكة (grid-world) أنه بينما يُظهر الوكلاء أداءً قويًا، فإن تمثيلاتهم الداخلية للخرائط المكانية وخطط العمل تخضع لإعادة تنظيم غير خطية أثناء عملية الاستنتاج، مما يسلط الضوء على ضرورة الفحص الاستبطاني لما يتجاوز مجرد الملاحظة السلوكية.

Raghu Arghal, Fade Chen, Niall Dalton, Evgenii Kortukov, Calum McNamara, Angelos Nalmpantis, Moksh Nirvaan, Gabriele Sar (…)2026-06-01
🤖 AI

Certified Circuits: Stability Guarantees for Mechanistic Circuits

تقدم هذه الورقة "الدوائر المعتمدة" (Certified Circuits)، وهو إطار عمل يعزز استقرار وموثوقية التفسير الآلي من خلال استخدام أخذ عينات فرعية عشوائية للبيانات لتوفير ضمانات مثبتة بأن الدوائر العصبية المكتشفة ثابتة تجاه اضطرابات مجموعة البيانات، مما يؤدي إلى تفسيرات أكثر إيجازاً ودقة عبر مختلف البنى والمهام.

Alaa Anani, Tobias Lorenz, Bernt Schiele, Mario Fritz, Jonas Fischer2026-06-01
💻 computer science

Gradient-Free Training of Spiking Neural Networks via Low-Rank Evolution Strategies

تقدم هذه الورقة البحثية EGGROLL، وهو تحليل ذو رتبة منخفضة لاستراتيجيات التطور يتيح تدريبًا فعالًا وخاليًا من التدرج للشبكات العصبية النبضية على الأجهزة العصبية من خلال تقليل التكاليف الحسابية وتكاليف الذاكرة بشكل كبير مع تحقيق دقة تنافسية على مجموعة بيانات N-MNIST.

Dhruv Patankar, Sachit Ramesha Gowda2026-06-01
💻 computer science

XOResNet: Exclusive-OR Meta-Residuals Facilitate Deep Spiking Neural Networks Learning

تقدم هذه الورقة البحثية XOResNet، وهي بنية شبكة عصبية نبضية عميقة تستخدم اتصال اختصار من نوع OR-ADD وبقايا ميتا-إكس-أور (Exclusive-OR meta-residuals) للتغلب على تكرار النبضات وفقدان المعلومات، مما يحقق أداءً فائقاً على النماذج الحالية الرائدة في عدة مجموعات بيانات مرجعية.

Jianfang Wu, Junsong Wang2026-06-01
⚡ electrical engineering

Hamiltonian-Inspired Attention Mechanism for Scalable RF Transmitter Fingerprinting

تقدم هذه الورقة "هاميلتونيان ترانسفورمر" (Hamiltonian Transformer)، وهي بنية انتباه مستوحاة من الفيزياء تفرض ديناميكيات حافظة للقيم المعيارية وتدمج تضمينات زيادة الطور لتحقيق قابلية توسع ومتانة فائقتين في تحديد ما يصل إلى 150 جهاز إرسال للترددات الراديوية من إشارات I/Q الخام تحت مختلف تحولات التوزيع مقارنة بالنماذج المرجعية الحالية من الشبكات العصبية الالتفافية (CNN) والمحولات (Transformer).

Chitraksh Singh, Monisha Dhanraj, Akram Sheriff2026-06-01