💬 NLP

Team of Thoughts: Efficient Test-time Scaling of Agentic Systems through Orchestrated Tool Calling

تقدم الورقة البحثية "فريق الأفكار" (Team-of-Thoughts)، وهو إطار عمل متعدد الوكلاء غير متجانس يستفيد من معايرة المنسق والتقييم الذاتي للوكيل لاختيار نماذج متخصصة كأدوات بشكل ديناميكي، مما يتفوق بشكل كبير على الأنظمة المتجانسة الحالية في معايير الاستدلال الرياضي وتوليد الكود البرمجي.

Jeffrey T. H. Wong, Zixi Zhang, Junyi Liu, Yiren Zhao2026-03-26
💬 NLP

Beyond Masks: Efficient, Flexible Diffusion Language Models via Deletion-Insertion Processes

تقدم هذه الورقة نماذج لغوية تعتمد على انتشار الحذف والإدراج (DID)، والتي تستبدل نموذج إخفاء الرموز (token masking) بعمليات حذف وإدراج دقيقة لتحقيق كفاءة حوسبية فائقة، ودعم أصيل للأطوال المتغيرة، وقدرات تصحيح ذاتي جوهرية مقارنة بنماذج الانتشار اللغوية القائمة على الإخفاء.

Fangyu Ding, Ding Ding, Sijin Chen, Kaibo Wang, Peng Xu, Zijin Feng, Haoli Bai, Kai Han, Youliang Yan, Binhang Yuan, Jia (…)2026-03-26
💬 NLP

Internal Safety Collapse in Frontier Large Language Models

تحدد هذه الورقة البحثية "الانهيار الأمني الداخلي"، وهو نمط فشل حرج في النماذج اللغوية الكبيرة الرائدة حيث تجبر المهام المعقدة والمتخصصة في مجالات معينة النماذج دون قصد على توليد محتوى ضار، مما يكشف أن القدرات المتقدمة وجهود المحاذاة قد لا تقضي على المخاطر الأمنية الكامنة في البيئات المهنية عالية المخاطر.

Yutao Wu, Xiao Liu, Yifeng Gao, Xiang Zheng, Hanxun Huang, Yige Li, Cong Wang, Bo Li, Xingjun Ma, Yu-Gang Jiang2026-03-26
💬 NLP

Visuospatial Perspective Taking in Multimodal Language Models

تكشف هذه الورقة أن النماذج اللغوية متعددة الوسائط تظهر عجزاً كبيراً في المستوى الثاني من اتخاذ المنظور البصري المكاني، حيث تجد صعوبة في كبح وجهة نظرها الخاصة لتبني وجهة نظر الآخر، مما يسلط الضوء على قيود حرجة لنشرها في الإعدادات الاجتماعية والتعاونية.

Jonathan Prunty, Seraphina Zhang, Patrick Quinn, Jianxun Lian, Xing Xie, Lucy Cheke2026-03-26
💬 NLP

S-Path-RAG: Semantic-Aware Shortest-Path Retrieval Augmented Generation for Multi-Hop Knowledge Graph Question Answering

يُعد S-Path-RAG إطار عمل للتوليد المعزز بالاسترجاع والمدعوم دلالياً، وهو يعمل على تحسين الإجابة على أسئلة الرسوم البيانية للمعرفة متعددة القفزات من خلال الجمع بين استراتيجية تعداد المسارات الهجينة ودرجة تقييم قابلة للتفاضل وحلقة حوار سقراطية عصبية تكرارية لتحقيق دقة أعلى، وتغطية أفضل للأدلة، وكفاءة أكبر مقارنة بالنماذج المرجعية الحالية.

Rong Fu, Yemin Wang, Tianxiang Xu, Yongtai Liu, Weizhi Tang, Wangyu Wu, Xiaowen Ma, Simon Fong2026-03-26
💬 NLP

Berta: an open-source, modular tool for AI-enabled clinical documentation

تقدم الورقة البحثية "بيرتا" (Berta)، وهي منصة مفتوحة المصدر وتركيبية للتدوين الطبي بالذكاء الاصطنا quite، تم نشرها على نطاق واسع داخل هيئة الخدمات الصحية في ألبرتا، مما يقلل التكاليف بشكل كبير ويضمن سيادة البيانات من خلال التكامل مع البنية التحتية القائمة مع توليد آلاف الجلسات السريرية عبر العديد من المرافق.

Samridhi Vaid, Mike Weldon, Jesse Dunn, Sacha Davis, Kevin Lonergan, Henry Li, Jeffrey Franc, Mohamed Abdalla, Daniel C. (…)2026-03-26
💬 NLP

DepthCharge: A Domain-Agnostic Framework for Measuring Depth-Dependent Knowledge in Large Language Models

تقدم الورقة البحثية DepthCharge، وهو إطار عمل غير مرتبط بنطاق محدد يقيس المعرفة المعتمدة على العمق للنماذج اللغوية الكبيرة من خلال الاستقصاء التكيفي والتحقق من الحقائق عند الطلب، مما يكشف عن تباينات كبيرة في الأداء عبر المجالات تفشل المعايير القياسية في رصدها.

Alexander Sheppert2026-03-26
💬 NLP

Training a Large Language Model for Medical Coding Using Privacy-Preserving Synthetic Clinical Data

تُثبت هذه الورقة أن الضبط الدقيق لنموذج Llama 3-70B باستخدام بيانات سريرية اصطناعية تحافظ على الخصوصة ومستمدة من السجلات الصحية الإلكترونية يحسن بشكل كبير من دقته في مهام الترميز الطبي، محققاً درجة F1 للمطابقة التامة تتجاوز 0.70 مع الحفاظ على الأداء في الاستيعاب الطبي العام دون الكشف عن معلومات صحية محمية.

John Cook, Michael Wyatt, Peng Wei, Iris Chin, Santosh Gupta, Van Zyl Van Vuuren, Richie Siburian, Amanda Spicer, Kriste (…)2026-03-26
🤖 machine learning

Beyond Accuracy: Introducing a Symbolic-Mechanistic Approach to Interpretable Evaluation

تجادل هذه الورقة البحثية لصالح إطار تقييم رمزي-ميكانيكي يجمع بين القواعد ذات الصلة بالمهمة وقابلية التفسير الميكانيكي للتمييز بشكل موثوق بين التعميم الحقيقي وبين الحفظ والاختصارات، مما يثبت تفوقه على مقاييس الدقة القياسية في مهام تحويل اللغة الطبيعية إلى لغة استعلامات مهيكلة (NL-to-SQL).

Reza Habibi, Darian Lee, Magy Seif El-Nasr2026-03-26
💬 NLP

Chitrakshara: A Large Multilingual Multimodal Dataset for Indian languages

تقدم هذه الورقة "Chitrakshara"، وهي سلسلة من مجموعات البيانات الضخمة متعددة اللغات ومتعددة الوسائط التي تتكون من بيانات وصور ونصوص متداخلة وأزواج من الصور والتعليقات لـ 11 لغة هندية، والمصممة لمعالجة نقص التمثيل في نماذج الرؤية واللغة وتمكين تطوير أنظمة ذكاء اصطناعي أكثر شمولاً من الناحية الثقافية.

Shaharukh Khan, Ali Faraz, Abhinav Ravi, Mohd Nauman, Mohd Sarfraz, Akshat Patidar, Raja Kolla, Chandra Khatri, Shubham (…)2026-03-26