💬 NLP

Generalistic or Specific Embeddings, Which is Better? An Empirical Study on Search for Clinical Coding in Non-English Languages

تُظهر هذه الدراسة أن نظام استرجاع الترميز السريري ثنائي المراحل، والذي تم ضبطه بدقة باستخدام بيانات اصطناعية متعددة اللغات من إنتاج النماذج اللغوية الكبيرة، يتفوق على النماذج المرجعية المدربة مسبقاً باللغة الإنجليزية في اللغات غير الإنجليزية، مما يقدم وصفة قابلة للتوسع لبناء أنظمة استرجاع طبية متخصصة دون الحاجة إلى تدريب مسبق واسع النطاق في المجال الطبي الحيوي باللغة الأصلية.

David Rey-Blanco, Roberto Cruz2026-06-01
💬 NLP

Speculative Decoding Across Languages

تتقصى هذه الورقة طرقاً لتعزيز كفاءة فك التشفير الاستباقي للغات غير الإنجليزية من خلال مقارنة الضبط الدقيق المخصص للمهام، والضبط الدقيق أحادي اللغة، ونماذج n-gram، حيث وجدت أنه في حين أن التقطير المخصص للمهام يحسن الكفاءة ولكنه يفتقر إلى التعميم، فإن نماذج n-gram تحقق باستمرار تسريعاً كبيراً بفضل توليدها السريع للمسودات رغم انخفاض معدلات القبول.

Nirajan Paudel, Michael Ginn, Luc De Nardi, Alexis Palmer2026-06-01
💬 NLP

ImmigrationQA: A Source-Grounded Dataset and Small-Model Adaptation for U.S. Immigration Law

تقدم هذه الورقة ImmigrationQA، وهي مجموعة بيانات مستندة إلى مصادر تتضمن أكثر من 17,000 زوج من الأسئلة والأجوبة المستمدة من لوائح الهجرة الأمريكية، وتثبت أن الضبط الدقيق لنموذج Llama 3.2 الصغير ذي الـ 3 مليارات معلمة على هذه البيانات يحسن أداءه بشكل كبير في استعلامات إجراءات الهجرة مقارنة بالنماذج الأساسية الأكبر، كل ذلك مع الحفاظ على تكلفة حوسبة منخفضة.

Nazarii Shportun2026-06-01
🤖 machine learning

Counterfactual Evaluation Reveals Hidden Capability Profiles in Clinical LLMs and Agents

تقدم هذه الورقة "درجة الحساسية السببية" (CSS)، وهي مقياس تدخلي يكشف عن تباينات جوهرية بين أداء نماذج الذكاء الاصطناٍعي السريري في معايير التغطية القياسية وبين استجابتها الفعلية للتغيرات الحرجة في بيانات المرضى، مما يكشف عن ملفات تعريف القدرات الخفية ونقاط العمى في السلامة الشاملة التي تغفل عنها طرق التقييم التقليدية.

Matt Turk2026-06-01
🤖 machine learning

AMNESIA: A Large Scale Medical Unlearning Benchmark Suite with Disease-Informed Analysis

تقدم هذه الورقة AMNESIA، وهي أول مجموعة اختبار مفتوحة المصدر وواسعة النطاق لعملية "إلغاء التعلم" (unlearning) في المجال الطبي، وتضم أكثر من 70,000 زوج من الأسئلة والأجوبة من 11 فئة من الأمراض، والتي تكشف أن طرق إلغاء التعلم الحالية تؤدي دون قصد إلى تدهور المعرفة بالحالات السريرية المشتركة عند إزالة بيانات مريض فردي.

Saeedeh Davoudi, Reihaneh Iranmanesh, Ophir Frieder, Nazli Goharian2026-06-01
🤖 AI

An Organization-Scoped LLM Agent Runtime Architecture for Regulated Cybersecurity Operations

تقترح هذه الورقة بنية تشغيل لوكلاء نماذج لغوية كبيرة (LLM) قابلة للنشر محلياً وعلى نطاق المؤسسة للأمن السيبراني المالي المنظم، والتي تفرض سياقاً أمنياً نمطياً عبر جميع المكونات، وتدمج أنظمة SIEM/XDR كمحفزات أساسية، وتضمن القابلية للتدقيق من خلال مهايئات أدوات محكومة، ونتائج مهيكلة، وبوابات تدخل بشري متعددة المستويات.

George Fatouros, Georgios Makridis, George Kousiouris, John Soldatos, Dimosthenis Kyriazis2026-06-01
💬 NLP

Semantic Motion Anchors: Bridging Motion and Meaning in Co-Speech Gestures

تقترح هذه الورقة البحثية "مرتكزات الحركة الدلالية"، وهي طريقة تعمل على تقطيع الإيماءات ثلاثية الأبعاد إلى وحدات حركة أولية بلغة طبيعية لسد الفجوة بين الكينماتيكا منخفضة المستوى والقصد التواصلي عالي المستوى، مما يحسن بشكل كبير استرجاع وتوليد إيماءات الكلام من خلال ربط الحركة بالمعنى الدلالي.

Varsha Suresh, Mohammad Mahdi Abootorabi, Mohamed Salman, M. Hamza Mughal, Christian Theobalt, Ashwin Ram, Jürgen Steiml (…)2026-06-01
🤖 machine learning

CSULoRA: Closest Safe Update Low-Rank Adaptation

تُعد CSULoRA طريقةً لاحقة (post-hoc) تحافظ على سلامة النماذج اللغوية الكبيرة المضبوطة دقيقًا من خلال تقدير فضاء فرعي متوافق مع السلامة وتطبيق حل تقليلي ذي تغيير أدنى بصيغة مغلقة لتخفيف اتجاهات تحديثات LoRA غير الآمنة مع الاحتفاظ بالمنفعة ذات الصلة بالمهمة.

Oleksandr Marchenko Breneur, Adelaide Danilov, Aria Nourbakhsh, Salima Lamsiyah2026-06-01
💬 NLP

COFT: Counterfactual-Conformal Decoding for Fair Chain-of-Thought Reasoning in Large Language Models

تُعد COFT طريقةً للتدريب في وقت فك التشفير، تعمل على تقليل التحيزات المجتمعية في استدلال تسلسل الأفكر (chain-of-thought) للنماذج اللغوية الكبيرة من خلال الجمع بين دمج اللوجيتات الواقعي المضاد والمعايرة المطابقة، مما يحقق تقليلاً كبيراً في التحيز مع الحفاظ على فائدة المهمة دون الحاجة إلى إعادة تدريب النموذج.

Arya Fayyazi, Mehdi Kamal, Massoud Pedram2026-06-01
💬 NLP

Same Patient, Different Words, Different Diagnosis? Evaluating Semantic Stability in Clinical LLMs

تقترح هذه الورقة إطار عمل للتحقق الدلالي ومقاييس جديدة لتقييم استقرار 16 نموذجاً من النماذج اللغوية الكبيرة، السريرية والعامة، تجاه تغيرات المطالبات التي تحافظ على المعنى، مما يكشف أن التخصص في المجال لا يضمن باستمرار تحقيق قدر أكبر من المتانة في سياقات الرعاية الصحية.

Mahdi Alkaeed, Adnan Qayyum, Nabeel Abo Kashreef, Muhammad Bilal, Junaid Qadir2026-06-01