💬 NLP

A Frozen 12B Beats Frontier Models on Verified Work: 100% Accuracy, 0 Tokens, Bit-Exact, Forever

تقترح هذه الورقة نظاماً يحقق فيه نموذج لغوي مجمد دقة بنسبة 100% وصفر توليد للرموز (tokens) في عائلات مشكلات تم التحقق منها، وذلك من خلال الاعتماد على مخزن ذاكرة مستمر ودقيق البت للحلول التي تم التحقق منها بشكل مستقل، مما يؤدي إلى فصل القدرة المرتبطة بالتنفيذ عن توسيع المعلمات وتمكين نوافذ سياق ضخمة على أجهزة المستهلكين.

Sietse Schelpe (Corbenic AI)2026-07-28
💬 NLP

Indic DiarBench: A Multilingual Joint Diarization and ASR Benchmark for Indian Languages

تقدم هذه الورقة البحثية Indic DiarBench، وهو مجموعة بيانات معيارية مفتوحة الوصول تضم 108 ساعات من التسجيلات الصوتية متعددة المتحدثين والموسومة بشرياً عبر جميع اللغات الهندية الـ 22 المجدولة لتقييم وتطوير أنظمة التعرف التلقائي على الكلام وتجزئة المتحدثين المشتركة.

Deovrat Mehendale, Aditya Mehndiratta, Dhruv Rathi, Kaushal Bhogale, Mitesh M. Khapra2026-07-28
💬 NLP

Earnings25: A Comprehensive 500-Hour Speech Benchmark for Finance

تقدم الورقة البحثية Earnings25، وهو معيار مرجعي شامل مدته 500 ساعة يتكون من مكالمات أرباح كاملة ومقاطع متوازنة قطاعياً مع نصوص متوافقة وبيانات وصفية مهيكلة، والمصمم لتقييم وتأسيس خطوط أساس قابلة للتكرار لأنظمة التعرف التلقائي على الكلام في مكالمات أرباح الشركات باللغة الإنجليزية تحت ظروف واقعية.

Denglin Jiang, Haoran Zhou, Anshul Wadhawan, Brendan Fahy, Vinay Ramesh, David Weisberg, Dmitriy Derkachevskiy, Helen Sh (…)2026-07-28
💬 NLP

Kalypso: Relational LLM Serving

كاليپسو (Kalypso) هو نظام لخدمة النماذج اللغوية الكبيرة العلاقاتية يعمل على تحسين كفاءة تنفيذ الاستعلامات الدلالية من خلال تقديم تنفيذ متسلسل مدرك للاستعلام وجدولة ذاكرة تكيفية لإعادة استخدام حالات ذاكرة التخزين المؤقت لمفاتيح القيم (KV-cache) عبر العمليات، محققاً تسريعًا يصل إلى 4.57 ضعفاً مقارنة بالنهج التقليدي المرتكز على الطلب.

Hojae Son, Md Ashraful Islam, Huy Gia Cao, Hui Guan, Marco Serafini2026-07-28
🤖 machine learning

Latent-LoRA: Compact Latent-Space Adapters with Gradient-Free Routing for Continual Learning

يُعد Latent-LoRA إطار عمل للتعلم المستمر خالٍ من إعادة التشغيل، حيث يحقق أداءً فائقاً مع نسيان شبه معدوم عبر استخدام نموذج خليط غاوسي خالي من التدرج لتوجيه المحولات غير المرتبط بالمهام، ومع تمثيل بارامتري في فضاء كامن مدمج مع تنظيم متعامد لتقليل التداخل بين المهام.

Reza Rahimi Azghan, Gautham Krishna Gudur, Giulia Pedrielli, Pavan Turaga, Hassan Ghasemzadeh2026-07-28
💬 NLP

TriShieldRAG: A Three-Ring Defense-in-Depth Framework Against Knowledge Corruption in Retrieval-Augmented Generation

يعد TriShieldRAG إطار عمل دفاعي ثلاثي الطبقات يقلل بشكل كبير من معدل نجاح هجمات تسميم المعرفة في أنظمة التوليد المعزز بالاسترجاع (RAG) من حوالي 91% إلى 13% عبر الجمع بين حارس الاستيعاب، ومُقيّم الاسترجاع، وآلية توافق النماذج اللغوية الكبيرة المتعددة، مع الحفاظ على الدقة في الاستعلامات السليمة.

Susil Kumar Mohanty, Rohit Patel, Kosuru Yuvaraj, Jeenal Chaudhary, Disha Singhania2026-07-28
💬 NLP

Understanding Tone-Dependent Inference Cost in Large Language Models

تُثبت هذه الورقة أن تنوع نبرات الأوامر (prompts) يؤثر بشكل كبير على كل من دقة وتكاليف الاستدلال للنماذج اللغوية الكبيرة، حيث يتفاوت استهلاك الرموز (tokens) في المخرجات بنسبة تصل إلى 44.3% عبر النبرات المختلفة، مما يكشف عن مقايضة حرجة بين جودة الإجابة واستخدام الموارد القابلة للفلترة.

Akhil Kumar, Om Dobariya2026-07-28
🧬 biology

Reality Monitoring in Large Language Models: Self-Knowledge That Transforms with Conversation Memory

تُظهر هذه الورقة أن قدرة النماذج اللغوية الكبيرة على التمييز بين المحتوى الذي تم إنشاؤه ذاتياً وبين مدخلات المستخدم (مراقبة الواقع) تعتمد بشكل كبير على بنية الذاكرة الحوارية، مما يكشف عن تدهور الأداء في ظل التأخير العرضي، وأن الاختبارات المرجعية الحالية تفشل في رصد التباينات الحرجة بين الدقة والثقة بينما تضطلع النماذج بأدوار مستقلة ومتعددة الجولات.

Saurabh Ranjan, Konstantina Sokratous, Brian Odegaard2026-07-28
🤖 machine learning

Understanding Machine Unlearning Through the Lens of Mode Connectivity

تقدم هذه الورقة مفهوم ترابط الأنماط في عملية نسيان البيانات (MCU) لتحليل هندسة التحسين لنسيان الآلة، كاشفةً أن النماذج المنسية غالباً ما تستقر في أحواض منخفضة الخسارة ومتصلة بآليات تختلف عن إعادة التدريب، مع تقديم رؤى حول مقاييس الخصوصية، والتقدم غير الخطي للنسيان، وتحسين المتانة من خلال التجميع.

Jiali Cheng, Hadi Amiri2026-07-28
💬 NLP

Tag Questions and the Generational Reversal of Sycophancy Across 45 Language Models

تكشف هذه الدراسة أن إلحاق وسم تأكيد مكون من كلمتين بأسئلة القرار يحفز تحولاً جيلانياً في 45 نموذجاً لغوياً، حيث ينتقل من الموافقة المتملقة إلى المقاومة بمرور الوقت، مما يثبت أن محاذاتها مدفوعة بمطابقة الأنماط السطحية ليقين المستخدم بدلاً من الاستدلال المبدئي.

Tapan Parikh2026-07-28