🤖 AI

Heterogeneous SoC Integrating an Open-Source Recurrent SNN Accelerator for Neuromorphic Edge Computing on FPGA

تقدم هذه الورقة نظاماً على شريحة (SoC) غير متجانس يعتمد على مصفوفة بوابات منطقية قابلة للبرمجة (FPGA)، يدمج مسرع الشبكة العصبية النبضية المتكررة مفتوح المصدر ReckOn مع معالجات RISC-V وARM لتمكين الحوسبة العصبية الطرفية ذات الكفاءة واستهلاك الطاقة المنخفض، والتي تم التحقق من صحتها من خلال تكافؤ الدقة مع السيليكون المصنع والتحقق من أداء التعلم عبر الإنترنت على مجموعة بيانات أرقام برايل.

Michelangelo Barocci, Vittorio Fra, Enrico Macii, Gianvito Urgese2026-05-13
🤖 machine learning

No More, No Less: Task Alignment in Terminal Agents

تقدم هذه الورقة "معيار محاذاة المهام" (TAB) لتقييم قدرة الوكلاء الطرفيين على اتباع التعليمات البيئية ذات الصلة بشكل انتقائي مع تجاهل المشتتات، مما يكشف أن الوكلاء الرائدين الحاليين يعانون في التمييز بينهما وأن آليات الدفاع الحالية غالبًا ما تقمع الإشارات الضارة والضرورية على حد سواء.

Sina Mavali, David Pape, Jonathan Evertz, Samira Abedini, Devansh Srivastav, Thorsten Eisenhofer, Sahar Abdelnabi, Lea S (…)2026-05-13
🔢 mathematics

Harness Engineering as Categorical Architecture

تؤسس هذه الورقة البحثية للبنية الفئوية باعتبارها الأساس النظري الرسمي لهندسة تسخير وكلاء النماذج اللغوية الكبيرة عبر رسم خرائط للأعمدة الأربعة لتجسيد الوكيل على الثلاثية (G, Know, Phi) الخاصة بإطار عمل ArchAgents، مما يتيح ضمانات هيكلية وتجميعاً عبر الأطر يتم التحقق منه من خلال الهوية وإعادة التشغيل بدلاً من صحة طبقة المخرجات.

Bogdan Banu2026-05-13
💬 NLP

Mind the Pause: Disfluency-Aware Objective Tuning for Multilingual Speech Correction with LLMs

تقترح هذه الورقة البحثية مسار معالجة لتصحيح الكلام متعدد اللغات يجمع بين كشف التلعثم على مستوى الرمز (token-level) والضبط الدقيق القائم على التعليمات وهدف التعلم التبايني لإزالة الحشوات والتكرارات من نصوص التعرف الآلي على الكلام (ASR) بفعالية مع الحفاظ على البنية النحوية والتماسك الدلالي، مما أظهر أداءً متفوقاً على النماذج المرجعية الحالية في لغات الهندية والبنغالية والماراثية.

Deepak Kumar, Baban Gain, Asif Ekbal2026-05-13
🤖 AI

Why Conclusions Diverge from the Same Observations: Formalizing World-Model Non-Identifiability via an Inference

تُصوّر هذه الورقة ظاهرة الاستنتاجات المتباينة من ملاحظات متطابقة بوصفها قضية بنيوية تتعلق بعدم قابلية تحديد النموذج العالمي (world-model non-identifiability) الناجمة عن اختلاف ملفات الاستدلال وانحيازات التعلم، بدلاً من كونها عيباً في العقلانية أو حسن النية.

Toru Takahashi2026-05-13✓ Author reviewed ⓘ
🤖 AI

Missingness-MDPs: Bridging the Theory of Missing Data and POMDPs

تقدم هذه الورقة نماذج عمليات ماركوف لاتخاذ القرار ذات البيانات المفقودة (missingness-MDPs)، وهي فئة فرعية جديدة من عمليات ماركوف لاتخاذ القرار بملكية جزئية (POMDPs) التي تُنمذج عدم قابلية ملاحظة سمات الحالة من خلال نظرية البيانات المفقودة، وتقترح خوارزميات التعلم الاحتمالي بأداء قريب من الأمثل (PAC) لتعلم دالة الفقدان الكامنة من بيانات المسار لاستخلاص سياسات مثالية بمقدار إبسيلون (ϵ\epsilon-optimal).

Joshua Wendland, Markel Zubia, Roman Andriushchenko, Maris F. L. Galesloot, Milan Ceska, Henrik von Kleist, Thiago D. Si (…)2026-05-13
🤖 AI

How Useful Is Cross-Domain Generalization for Training LLM Monitors?

تُثبت هذه الورقة أن الضبط الدقيق للنماذج اللغوية على مهام تصنيف متعددة عبر مجالات مختلفة يحسن الأداء في المجالات غير المرئية، رغم أنها قد تعاني من تغيرات الأوامر، وهو قصور يمكن التخفيف من حدته عن طريق خلط تدريب التصنيف مع اتباع التعليمات العامة لتمكين نماذج قوية لا تتطلب تفكيراً وتعمم على مهام الاستدلال المعقدة.

Sam Martin, Fabien Roger2026-05-13
🤖 AI

Iterative Audit Convergence in LLM-Managed Multi-Agent Systems: A Case Study in Prompt Engineering Quality Assurance

تقدم هذه الورقة دراسة حالة لعملية تدقيق تكرارية مدفوعة بالوكلاء طُبقت على نظام AEGIS متعدد الوكلاء، والتي استخدمت تسع جولات متتالية من عمليات التفتيش القائمة على النماذج اللغوية الكبيرة لتحديد 51 عيباً في مواصفات الأوامر البرمجية، ووضع تصنيف جديد للعيوب، وإثبات التقارب غير الرتيب في بيئة إنتاج.

Elias Calboreanu2026-05-13
💬 NLP

TokenRatio: Principled Token-Level Preference Optimization via Ratio Matching

تقدم هذه الورقة البحثية "تحسين تفضيل بريغمان على مستوى الرمز" (TBPO)، وهي طريقة مبتكرة تشتق نموذج تفضيل "برادلي-تيري" على مستوى الرمز من مقارنات معيارية على مستوى التسلسل لتحسين جودة المحاذاة، واستقرار التدريب، وتنوع المخرجات، مع الحفاظ على بساطة "التحسين المباشر للتفضيلات" (DPO).

Truong Nguyen, Tien-Phat Nguyen, Linh Ngo Van, Duy Minh Ho Nguyen, Khoa Doan, Trung Le2026-05-13
🤖 machine learning

PriorZero: Bridging Language Priors and World Models for Decision Making

يُعد PriorZero إطار عمل موحداً يسد الفجوة بين المعارف المسبقة الساكنة للنماذج اللغوية الكبيرة والنماذج العالمية الديناميكية من خلال حقن توجيه النموذج اللغوي الكبير حصرياً عند جذر بحث مونت كارلو في الأشجار من أجل استكشاف مركز، وفصل تدريب النموذج العالمي عن تكيف النموذج اللغوي الكبير لتمكين تخصيص ائتمان مستقر ودقيق، مما يعزز بشكل كبير كفاءة وأداء اتخاذ القرار في المهام طويلة الأمد.

Junyu Xiong, Yuan Pu, Jia Tang, Yazhe Niu2026-05-13