🤖 machine learning

Transparent Screening for LLM Inference and Training Impacts

تقدم هذه الورقة إطار عمل شفافاً وقابلاً للتدقيق يحول أوصاف التطبيقات باللغة الطبيعية إلى تقديرات بيئية محددة لتمكين التحليل المقارن لآثار الاستدلال والتدريب لنماذج اللغات الكبيرة، لا سيما بالنسبة للخدمات المملوكة غير الشفافة حيث لا تتوفر إمكانية القياس المباشر.

Arnault Pachot, Thierry Petit2026-04-23
💻 computer science

ThermoQA: A Three-Tier Benchmark for Evaluating Thermodynamic Reasoning in Large Language Models

تقدم الورقة البحثية ThermoQA، وهو معيار مفتوح المصدر ثلاثي المستويات يتكون من 293 مسألة في الديناميكا الحرارية تم تقييمها مقابل الحقيقة المرجعية لـ CoolProp 7.2.0، والذي يكشف أنه بينما تحقق النماذج اللغوية الكبيرة الرائدة دقة عالية، فإن قدراتها على الاستنتاج تتدهور بشكل كبير مع زيادة تعقيد المهام وتظهر تباينًا ملحوظًا عبر عمليات التشغيل.

Kemal Düzkar2026-04-23
💬 NLP

Evidence of Layered Positional and Directional Constraints in the Voynich Manuscript: Implications for Cipher-Like Structure

تحدد هذه الورقة قيوداً اتجاهية فريدة في تتابعات الحروف في مخطوطة فوينيتش تميزها عن اللغات الطبيعية، وتثبت أن كلاً من المولدات القائمة على الفتحات البارامترية أو مولدات شبكة كاردان لا يمكنها إعادة إنتاج توقيعاتها الهيكلية بالكامل، مما يشير إلى أن النص يمتلك خصائص معقدة تشبه التشفير تقاوم النماذج التوليدية البسيطة.

Christophe Parisel2026-04-23
💬 NLP

Do Hallucination Neurons Generalize? Evidence from Cross-Domain Transfer in LLMs

تُثبت هذه الورقة أن "عصبونات الهلوسة" التي تم تحديدها في النماذج اللغوية الكبيرة لا تتعمم عبر مجالات معرفية مختلفة، مما يكشف أن آليات الهلوسة محددة بمجال معين وليست عالمية، مما يستلزم وجود كواشف مُعايرة وفقاً للمجال.

Snehit Vaddi, Pujith Vaddi2026-04-23
💬 NLP

PR-CAD: Progressive Refinement for Unified Controllable and Faithful Text-to-CAD Generation with Large Language Models

يقدم PR-CAD إطار عمل صقل تدريجي يوحد بين توليد وتعديل نماذج CAD من النص في وكيل واحد قابل للتحكم، وذلك عبر الاستفادة من مجموعة بيانات تفاعلية عالية الدقة والتعلم التعزيزي لتحقيق أحدث المعايير في دقة وكفاءة نمذجة CAD.

Jiyuan An, Jiachen Zhao, Fan Chen, Liner Yang, Zhenghao Liu, Hongyan Wang, Weihua An, Meishan Zhang, Erhong Yang2026-04-23
💻 computer science

From Actions to Understanding: Conformal Interpretability of Temporal Concepts in LLM Agents

تقدم هذه الورقة إطاراً للتفسير المطابق يجمع بين نمذجة المكافأة الخطوية والتنبؤ المطابق لتحديد وتوجيه المفاهيم الزمنية القابلة للفصل خطياً داخل وكلاء النماذج اللغوية الكبيرة، مما يتيح الكشف المبكر عن الفشل وتحسين الأداء في البيئات التفاعلية المعقدة.

Trilok Padhi, Ramneet Kaur, Krishiv Agarwal, Adam D. Cobb, Daniel Elenius, Manoj Acharya, Colin Samplawski, Alexander M. (…)2026-04-23
💬 NLP

Towards High-Quality Machine Translation for Kokborok: A Low-Resource Tibeto-Burman Language of Northeast India

تقدم هذه الورقة KokborokMT، وهو نظام ترجمة آلية عصبية عالي الجودة للغة كوكبوروك (Kokborok) من عائلة اللغات التيبتية البرمانية ذات الموارد المنخفضة، والذي يستفيد من متن موازٍ متعدد المصادر ونماذج NLLB-200 مضبوطة بدقة لتحقيق تحسينات كبيرة في درجة BLEU (تصل إلى 38.56) وتقييمات قوية في التقييم البشري مقارنة بالمحاولات السابقة.

Badal Nyalang, Biman Debbarma2026-04-23
💻 computer science

Do Small Language Models Know When They're Wrong? Confidence-Based Cascade Scoring for Educational Assessment

تُثبت هذه الورقة أن التعبير اللفظي عن الثقة في النماذج اللغوية الصغيرة يمكن أن يوجه مهام التقييم التعليمي بفعالية إلى نماذج أكبر في نظام متتالي موفر للتكلفة، شريطة أن تُظهر النماذج الصغيرة قدرة قوية على التمييز بين مستويات الثقة لتحديد الحالات غير المؤكدة بدقة.

Tyler Burleigh2026-04-23
💬 NLP

How Much Does Persuasion Strategy Matter? LLM-Annotated Evidence from Charitable Donation Dialogues

من خلال ترميز مجموعة بيانات PersuasionForGood باستخدام 41 استراتيجية إقناع عبر ثلاثة نماذج لغوية كبيرة، تجد هذه الدراسة أن فئات الاستراتيجيات وحدها تفسر قدراً ضئيلاً من التباين في نتائج التبرع، مع ملاحظة أن استثارة الشعور بالذنب تقلل الامتثال بشكل كبير، بينما يظهر التبادلية أقوى ارتباط إيجابي.

Tatiana Petrova, Stanislav Sokol, Radu State2026-04-23
⚡ electrical engineering

Enhancing ASR Performance in the Medical Domain for Dravidian Languages

تقترح هذه الورقة إطار عمل تدريب مبتكر يعتمد على الوعي بالثقة، يدمج بين بيانات الكلام الحقيقية والاصطناعية باستخدام مقاييس هجينة ثابتة وديناميكية لتقليل معدلات خطأ الكلمات بشكل كبير في أنظمة التعرف التلقائي على الكلام الطبية للغتين التيلوجوية والكانادا، متفوقة بذلك على النماذج المرجعية للضبط الدقيق القياسي بنسبة 8.5% و6.3% على التوالي.

Sri Charan Devarakonda, Ravi Sastry Kolluru, Manjula Sri Rayudu, Rashmi Kapoor, Madhu G, Anil Kumar Vuppala2026-04-23