💬 NLP

Medical Context Distorts Decisions in Clinical Vision Language Models

تكشف هذه الورقة أن نماذج الرؤية واللغة السريرية غالباً ما تخفق في السيناريوهات الواقعية من خلال الاعتماد المفرط على المعلومات النصية، والتضليل بواسطة التاريخ السريري غير ذي الصلة، وإظهار حساسية عالية تجاه تغيرات الأوامر البرمجية، مما يؤكد الحاجة الماسة لاختبارات الإجهاد الصارمة والضمانات قبل نشرها في الممارسة الطبية.

David Restrepo, Ira Ktena, Maria Vakalopoulou, Stergios Christodoulidis, Enzo Ferrante2026-05-19
💬 NLP

FastOCR: Dynamic Visual Fixation via KV Cache Pruning for Efficient Document Parsing

يُعد FastOCR إطار عمل لا يتطلب تدريباً يعمل على تسريع تحليل المستندات في نماذج الرؤية واللغة من خلال الاستفادة من الطبيعة المتناثرة زمنياً للانتباه البصري لتقليم وإعادة استخدام رموز ذاكرة التخزين المؤقت لـ (KV) ديناميكياً عند كل خطوة فك تشفير، مما يحقق تقليلاً كبيراً في زمن الاستجابة مع حد أدنى من الفقد في الدقة.

Zihan Tang, Leqi Shen, Hui Chen, Ao Wang, Ben Wan, Yan Feng, Ke Zhang, Sicheng Zhao, Tongxuan Liu, Guiguang Ding2026-05-19
💬 NLP

Trust No Tool: Evaluating and Defending LLM Agents under Untrusted Tool Feedback

تقدم هذه الورقة مفهوم "التسمم المعرفي" في وكلاء النماذج اللغوية الكبيرة، حيث تقوم الأدوات الخبيثة ببناء الثقة من خلال تقديم تغذية راجعة حميدة قبل تنفيذ إجراءات ضارة، وتقترح معيار TRUST-Bench والاطار الدفاعي VISTA-Guard للكشف بفعالية عن هذه المخاطر القائمة على المسار والتخفيف من حدتها عبر تقييم الإجراء التنفيذي النهائي بدلاً من الاعتماد على الاستدلالات القائمة على مستوى المطالبة.

Lecheng Yan, Ruizhe Li, Xicheng Han, Wenxi Li, Binwu Wang, Longyue Wang, Chenyang Lyu, Guanhua Chen2026-05-19
💬 NLP

Hybrid Feature Combinations with CNN for Bangla Fake News Classification

يُظهر هذا البحث أن الجمع بين الميزات الدلالية والإحصائية وميزات مستوى الحروف يعزز بشكل كبير أداء نموذج الشبكة العصبية التلافيفية (CNN) للكشف عن الأخبار الزائفة باللغة البنغالية على مجموعة بيانات BanFakeNews-2.0 مقارنة باستخدام الميزات الفردية وحدها.

Md Gulzar Hussain, Babe Sultana, Md Rinku Ali2026-05-19
💬 NLP

Generalization or Memorization? Brittleness Testing for Chess-Trained Language Models

تتحدى هذه الورقة البحثية المفهوم القائل بأن الدرجات المرتف High في الاختبارات المعيارية للنماذج اللغوية المدربة على الشطرنج تشير إلى فهم حقيقي للقواعد، محتجةً بدلاً من ذلك بأن أداءها ينبع من مطابقة الأنماط، ومبينةً أن دمج النماذج اللغوية الكبيرة العامة مع أدوات تحقق خارجية يوفر بديلاً أكثر مرونة وفعالية من حيث التكلفة مقارنة بالضبط الدقيق المتخصص.

Ethan Tang2026-05-19
💬 NLP

Temporal Decay of Co-Citation Predictability: A 20-Year Statute Retrieval Benchmark from 396M Ukrainian Court Citations

تقدم هذه الورقة معيار UA-StatuteRetrieval، وهو تحليل طولي لـ 396 مليون استشهاد قضائي أوكراني، والذي يوضح أن قابلية التنبؤ بالاستشهاد المشترك تتدهور بشكل كبير على مدى فترة 20 عاماً بسبب التحولات الزمنية في التفسير القانوني والانزياح الدلالي، لا سيما في القانون المدني والمواد متوسطة التكرار، مما يتحدى افتراض استقرار إشارات الاسترجاع في نظم المعلومات القانونية.

Volodymyr Ovcharov2026-05-19
💬 NLP

Beyond Transcripts: Iterative Peer-Editing with Audio Unlocks High-Quality Human Summaries of Conversational Speech

تُظهر هذه الورقة أنه بينما تكون الملخصات البشرية القائمة على الصوت أقل إفادة في البداية من تلك القائمة على النصوص المكتوبة، فإن سير عمل التحرير الجماعي التكراري يسد هذه الفجوة بفعالية، مما يتيح إنشاء معايير مرجعية عالية الجودة لتلخيص الكلام حتى في غياب النصوص المكتوبة.

Kaavya Chaparala, Thomas Thebaud, Jesús Villalba López, Laureano Moro-Velazquez, Peter Viechnicki, Najim Dehak2026-05-19
💬 NLP

Validate Your Authority: Benchmarking LLMs on Multi-Label Precedent Treatment Classification

تقدم هذه الورقة مجموعة بيانات جديدة مشروحة من قبل خبراء ومقياس "متوسط خطأ الشدة" (Average Severity Error) المبتكر لتقييم النماذج اللغوية الكبيرة في تصنيف معالجة السوابق القانونية متعددة التصنيفات، كاشفةً أنه بينما يتفوق Gemini 2.5 Flash في المهام عالية المستوى، فإن GPT-5-mini يتفوق في المخططات المعقدة دقيقة التفاصيل.

M. Mikail Demir, M. Abdullah Canbaz2026-05-19
💬 NLP

Do LLM Agents Mirror Socio-Cognitive Effects in Power-Asymmetric Conversations?

تُظهر هذه الورقة أن النماذج اللغوية الكبيرة التي تُسند إليها شخصيات ذات مكانة عالية أو منخفضة تُظهر آثاراً اجتماعية معرفية رئيسية لعدم تماثل القوة — مثل التنسيق اللغوي، وتحولات استخدام الضمائر، والنجاح في الإقناع، والامتثال للطلبات غير الآمنة — مما يعكس ديناميكيات مماثلة لتلك الملاحظة في التواصل البشري.

Anvesh Rao Vijjini, Sagar Manjunath, Snigdha Chaturvedi2026-05-19
💬 NLP

Sometin Beta Pass Notin (SBPN): Improving Multilingual ASR for Nigerian Languages via Knowledge Distillation

تقدم الورقة البحثية نموذج "Sometin Beta Pass Notin" (SBPN)، وهو نموذج أساسي للتعرف التلقائي على الكلام متعدد اللغات للغات النيجيرية، والذي يستفيد من عملية تقطير معرفي مكونة من مرحلتين لتقليل معدلات خطأ الكلمات بشكل كبير والتفوق على الأنظمة الحالية الرائدة رغم تحديات مثل ندرة البيانات والتعقيد النغمي.

Sewade Ogun2026-05-19