💬 NLP

Berta: an open-source, modular tool for AI-enabled clinical documentation

تقدم الورقة البحثية "بيرتا" (Berta)، وهي منصة مفتوحة المصدر وتركيبية للتدوين الطبي بالذكاء الاصطنا quite، تم نشرها على نطاق واسع داخل هيئة الخدمات الصحية في ألبرتا، مما يقلل التكاليف بشكل كبير ويضمن سيادة البيانات من خلال التكامل مع البنية التحتية القائمة مع توليد آلاف الجلسات السريرية عبر العديد من المرافق.

Samridhi Vaid, Mike Weldon, Jesse Dunn, Sacha Davis, Kevin Lonergan, Henry Li, Jeffrey Franc, Mohamed Abdalla, Daniel C. (…)2026-03-26
💬 NLP

DepthCharge: A Domain-Agnostic Framework for Measuring Depth-Dependent Knowledge in Large Language Models

تقدم الورقة البحثية DepthCharge، وهو إطار عمل غير مرتبط بنطاق محدد يقيس المعرفة المعتمدة على العمق للنماذج اللغوية الكبيرة من خلال الاستقصاء التكيفي والتحقق من الحقائق عند الطلب، مما يكشف عن تباينات كبيرة في الأداء عبر المجالات تفشل المعايير القياسية في رصدها.

Alexander Sheppert2026-03-26
💬 NLP

Training a Large Language Model for Medical Coding Using Privacy-Preserving Synthetic Clinical Data

تُثبت هذه الورقة أن الضبط الدقيق لنموذج Llama 3-70B باستخدام بيانات سريرية اصطناعية تحافظ على الخصوصة ومستمدة من السجلات الصحية الإلكترونية يحسن بشكل كبير من دقته في مهام الترميز الطبي، محققاً درجة F1 للمطابقة التامة تتجاوز 0.70 مع الحفاظ على الأداء في الاستيعاب الطبي العام دون الكشف عن معلومات صحية محمية.

John Cook, Michael Wyatt, Peng Wei, Iris Chin, Santosh Gupta, Van Zyl Van Vuuren, Richie Siburian, Amanda Spicer, Kriste (…)2026-03-26
🤖 machine learning

Beyond Accuracy: Introducing a Symbolic-Mechanistic Approach to Interpretable Evaluation

تجادل هذه الورقة البحثية لصالح إطار تقييم رمزي-ميكانيكي يجمع بين القواعد ذات الصلة بالمهمة وقابلية التفسير الميكانيكي للتمييز بشكل موثوق بين التعميم الحقيقي وبين الحفظ والاختصارات، مما يثبت تفوقه على مقاييس الدقة القياسية في مهام تحويل اللغة الطبيعية إلى لغة استعلامات مهيكلة (NL-to-SQL).

Reza Habibi, Darian Lee, Magy Seif El-Nasr2026-03-26
💬 NLP

Chitrakshara: A Large Multilingual Multimodal Dataset for Indian languages

تقدم هذه الورقة "Chitrakshara"، وهي سلسلة من مجموعات البيانات الضخمة متعددة اللغات ومتعددة الوسائط التي تتكون من بيانات وصور ونصوص متداخلة وأزواج من الصور والتعليقات لـ 11 لغة هندية، والمصممة لمعالجة نقص التمثيل في نماذج الرؤية واللغة وتمكين تطوير أنظمة ذكاء اصطناعي أكثر شمولاً من الناحية الثقافية.

Shaharukh Khan, Ali Faraz, Abhinav Ravi, Mohd Nauman, Mohd Sarfraz, Akshat Patidar, Raja Kolla, Chandra Khatri, Shubham (…)2026-03-26
💬 NLP

Qworld: Question-Specific Evaluation Criteria for LLMs

تقدم "كيو وورلد" (Qworld) إطار تقييم مبتكرًا يولد معايير خاصة بكل سؤال من خلال شجرة توسع تكرارية، مما يتيح تقييمًا أكثر دقة ومراعاةً للسياق للنماذج اللغوية الكبيرة في المهام مفتوحة النهايات مقارنة بالنماذج المرجعية الثابتة التقليدية.

Shanghua Gao, Yuchang Su, Pengwei Sui, Curtis Ginder, Marinka Zitnik2026-03-26
💬 NLP

Do 3D Large Language Models Really Understand 3D Spatial Relationships?

تكشف هذه الورقة أن النماذج اللغوية الكبيرة ثلاثية الأبعاد الحالية تعتمد غالباً على اختصارات نصية بدلاً من الاستدلال المكاني ثلاثي الأبعاد الحقيقي، مما دفع المؤلفين إلى تقديم معيار Real-3DQA وهدف تدريب يعيد وزن البيانات ثلاثية الأبعاد لتقييم وتحسين الفهم ثلاثي الأبعاد الحقيقي بصرامة.

Xianzheng Ma, Tao Sun, Shuai Chen, Yash Bhalgat, Jindong Gu, Angel X Chang, Iro Armeni, Iro Laina, Songyou Peng, Victor (…)2026-03-26
💬 NLP

Navigating the Concept Space of Language Models

تقدم هذه الورقة Concept Explorer، وهو نظام تفاعلي قابل للتوسع يستخدم تضمينات الجوار الهرمية لتنظيم وتمكين التنقل التدريجي متعدد الدقة لميزات المشفّر التلقائي المتناثر (sparse autoencoder) لاكتشاف وتحليل المفاهيم القابلة للتفسير البشري في النماذج اللغوية الكبيرة.

Wilson E. Marcílio-Jr, Danilo M. Eler2026-03-26
💬 NLP

Plato's Cave: A Human-Centered Research Verification System

تقدم هذه الورقة "أفلاطون كاف" (Plato's Cave)، وهو نظام مفتوح المصدر متمحور حول الإنسان، يقوم بالتحقق من الأوراق البحثية عبر بناء رسم بياني موجه غير حلقي لحججها، باستخدام وكلاء ويب لتعيين درجات المصداقية، وتقييم البنية الحجاجية الإجمالية لإنشاء تقييم نهائي.

Matheus Kunzler Maldaner, Raul Valle, Junsung Kim, Tonuka Sultan, Pranav Bhargava, Matthew Maloni, John Courtney, Hoang (…)2026-03-26
💬 NLP

Konkani LLM: Multi-Script Instruction Tuning and Evaluation for a Low-Resource Indian Language

تتناول هذه الورقة البحثية عجز الأداء في النماذج اللغوية الكبيرة في لغة كونكاني ذات الموارد المنخفضة ومتعددة النصوص عبر تقديم مجموعة بيانات "Konkani-Instruct-100k" الاصطناعية ونموذج "Konkani LLM" الناتج عنها، والذي يُظهر أداءً تنافسيًا أو متفوقًا على النماذج المرجعية المملوكة في مهام ضبط التعليمات والترجمة الآلية.

Reuben Chagas Fernandes, Gaurang S. Patkar2026-03-26