🤖 AI

From Single Chatbots to Governed Agent Ecosystems: An Agentic AI Pattern Catalogue and Orchestration Framework for Mission-Critical Hospital Information Management Systems

تقترح هذه الورقة إطار عمل للتنسيق يضع الامتثال في المقام الأول ودليل أنماط للانتقال بأنظمة معلومات المستشفيات من تجارب برامج الدردشة الآلية المنفردة والمجزأة إلى منظومات متعددة الوكلاء ومنضبطة تضمن الالتزام التنظيمي، والمرونة التشغيلية، والعائد المستدام على الاستثمار من خلال النشر الآمن داخل المنشأة وحوكمة العنصر البشري في الحلقة التوجيهية.

Manideep Dhar, Ritwik Singh, Sharat Chandra Kumar Manikonda2026-08-11
💬 NLP

Embedding Initialization for Unseen Low-resource Languages in Multilingual NMT: A Case Study on Limbum-English Translation

تُثبت هذه الورقة أن تهيئة نماذج الترجمة الآلية العصبية متعددة اللغات باستخدام متوسط التضمينات من لغات ذات صلة تصنيفية يحقق أداءً في الترجمة للغة ليمبوم (Limbum) ذات الموارد المنخفضة يضاهي أفضل طريقة تعتمد على وسيط لغوي منفرد، متفوقاً بشكل ملحوظ على التدريب من الصفر مع إلغاء الحاجة إلى اختيار الوسيط بناءً على قواعد استدلالية.

Samiratu Ntohsi, Neza David Tuyishimire, Anesu Kafesu, Marvin Ogore, Samuel Oluwajunwonlo Babalola, Oche Ankeli2026-08-11
💬 NLP

SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators

تقدم هذه الورقة البحثية SurveyReview، وهو معيار ومجموعة بيانات متعددة الأبعاد ومبتكرة تضم 675 ورقة بحثية استقصائية مشروحة، صُممت لمواءمة المقيمين الآليين القائمين على النماذج اللغوية الكبيرة (LLMs) بشكل منهجي مع المراجعين البشريين، إلى جانب SurveyAlign، وهو نموذج أساسي مضبوط بدقة يتفوق بشكل كبير على الأساليب القائمة على التلقين الحالية في مطابقة درجات التقييم البشري.

Yuheng Zhang, Yuanchun Wang, Fanjin Zhang, Ruyu Zhao, Juanzi Li, Jie Tang, Jing Zhang2026-08-11
💬 NLP

Keep It Simple: Multi-Key Episodic Memory Retrieval for Ultra-Long Video Understanding

تقترح الورقة البحثية إطار عمل MERIT، وهو إطار بسيط وفعال لفهم الفيديو فائق الطول يعطي الأولوية لبناء ذاكرة حلقية (episodic memory) ذات استدعاء عالٍ باستخدام تمثيلات متعددة المفاتيح، ويؤجل الاستدلال الدلالي المعقد إلى وقت الاستنتاج من خلال التوسع الزمني عند الطلب، محققاً أداءً هو الأفضل في فئته دون العبء الحسابي لنمذجة العلاقات العالمية مسبقاً.

Yeeun Choi, Youngbeom Yoo, Joon-Young Lee, Hyolim Kang, Seon Joo Kim2026-08-11
💬 NLP

On the use of foundation models in cognitive science

تقترح هذه الورقة إطاراً استدلالياً من أربع مراحل لتقييم النماذج التأسيسية بصرامة كنماذج معرفية وتنموية، محاجةً بأن المحاذاة السلوكية وحدها غير كافية ويجب أن تكون مرتكزة على التزامات نظرية صريحة، وربط للفرضيات، وتقييم مقارن منهجي.

Raj Sanjay Shah, Alex Warstadt, Michael Frank, Sashank Varma2026-08-11
🤖 machine learning

From token probabilities to calibrated confidence: An empirical study of mathematical question answering

تتقصى هذه الدراسة التجريبية طرق معايرة الثقة في النماذج اللغوية الكبيرة للإجابة على الأسئلة الرياضية، وتجد أنه بينما توفر احتمالات الرموز (tokens) في المرة الواحدة إشارة محدودة، فإن تجميعها وتوظيف استراتيجيات متعددة المرات مثل التحقق الذاتي أو إسقاط مونت كارلو (Monte Carlo Dropout)، متبوعة بتقنيات المعايرة البعدية، يمكن أن يحسن بشكل كبير من التوافق بين الثقة المقدرة والدقة الفعلية.

Avery Ma, Lorne Schell, Vin Bhaskara, Leila Pishdad2026-08-11
💬 NLP

"Many Are My Names": The Anatomy of the Assistant and Its Personas via Sparse Autoencoders

تستخدم هذه الورقة المشفّرات التلقائية المتناثرة (sparse autoencoders) لتكشف أن شخصيات النماذج اللغوية (مثل شخصيات لعب الأدوار) تحتفظ بمجموعة سمات "مساعد" جوهرية بينما تتمايز تدريجياً في الطبقات الأعمق، في حين تفتقر شخصيات القصص إلى هذا الجوهر تماماً، مما يسلط الض الضوء على وجود متصل هيكلي بين أوضاع المحاكاة الافتراضية والغامرة.

Adelaide Danilov, Aria Nourbakhsh, Oleksandr Marchenko Breneur, Salima Lamsiyah2026-08-11
💬 NLP

Thinking Hard, Not Smart: Reasoning Models Fail to Ration Test-Time Compute Across Questions

تقدم هذه الورقة إطار تقييم يحاكي نمط الامتحانات، يكشف أن نماذج الاستدلال الحالية تفشل في تخصيص ميزانية حوسبة وقت الاختبار المشتركة بشكل استراتيجي عبر أسئلة متعددة، بل تتصرف كحلّالات تسلسلية جشعة تعطي الأولوية لترتيب العرض على حساب صعوبة السؤال أو قيمته.

Chenrui Fan, Yize Cheng, Ming Li, Yongyuan Liang, Tianyi Zhou, Soheil Feizi2026-08-11
⚡ electrical engineering

The Voiceprint Fallacy: Why Voices Are Not Unique Biometric Imprints

تجادل هذه الورقة بأن مفهوم "بصمة الصوت" كمعرّف بيومتري فريد ومستقر هو مغالطة مضللة علمياً، وتدعو بدلاً من ذلك إلى تفسير أدلة الصوت من خلال أطر احتمالية موثقة تأخذ في الاعتبار صراحةً التباين وعدم اليقين المتأصلين في الكلام البشري.

Tianle Yang, Cuiling Zhang, Chengzhe Sun, Siwei Lyu, Phil Rose2026-08-11
🤖 AI

Decided Upstream, Written Late: Locating and Pricing the Cross-Lingual Refusal Circuit of a Multilingual MoE

تكشف هذه الورقة أن الفجوات الأمنية عبر اللغات في نماذج "خليط الخبراء" متعددة اللغات لا تنبع من الفشل في اكتشاف الضرر، بل من آلية رفض تعتمد على اللغة وتحدث في مرحلة متأخرة، والتي يمكن إصلاحها بفعالية وبتكلفة زهيدة عن طريق تخميد دائرة "معارضة" محددة قائمة على الانتباه بدلاً من تضخيم الكاتب أو إجراء تعديلات جراحية.

Ramakrishna P. Kompella, Aadit Mahajan2026-08-11