💬 NLP

Timing is Everything: Temporal Scaffolding of Semantic Surprise in Humor

تقدم هذه الورقة إطار عمل "انتهاك التنبؤ المزدوج" (DPV) وتحلل 828 عرضًا من عروض الكوميديا الارتجالية الصينية لتثبت أن الديناميكيات الزمنية، ولا سيما الوقفات الاستراتيجية وذروة الانتهاكات الدلالية، هي أكثر أهمية من عدم الاتساق الدلالي المتوسط في التنبؤ بتقدير الفكاهة، مما يعيد صياغة الفكاهة كعملية معرفية مدعومة زمنياً.

Yuxi Ma, Yongqian Peng, Junchen Lyu, Chi Zhang, Yixin Zhu2026-05-04
💬 NLP

RouteProfile: Elucidating the Design Space of LLM Profiles for Routing

تقدم هذه الورقة RouteProfile، وهو فضاء تصميم شامل لملفات تعريف النماذج اللغوية الكبيرة (LLM profiles) مهيكل عبر أربعة أبعاد رئيسية، وتثبت من خلال تقييم منهجي أن ملفات التعريف المهيكلة على مستوى الاستعلام تعزز بشكل كبير أداء التوجيه والتعميم عبر آليات التوجيه المتنوعة.

Jingjun Xu, Hongji Pu, Tao Feng, Haozhen Zhang, Jiaxuan You, Ge Liu2026-05-04
💬 NLP

Confidence Estimation in Automatic Short Answer Grading with LLMs

تقترح هذه الورقة إطار عمل هجين للثقة لتقييم الإجابات القصيرة تلقائياً، يجمع بين الإشارات القائمة على النماذج واللايقين العشوائي المستمد من مجموعة البيانات لإنتاج تقديرات ثقة أكثر موثوقية وتحسين أداء التقييم الانتقائي مقارنة بالنهج أحادي المصدر.

Longwei Cong, Sonja Hahn, Sebastian Gombert, Leon Camus, Hendrik Drachsler, Ulf Kroehne2026-05-04
💬 NLP

Persona-Grounded Safety Evaluation of AI Companions in Multi-Turn Conversations

تقدم هذه الورقة إطار عمل شاملاً وقابلاً للتوسع لمحاكاة التفاعلات متعددة الأدوار مع الرفقاء الاصطناعيين باستخدام شخصيات مثبتة سريرياً لتقييم مخاطر السلامة، كاشفةً أن تطبيق ريبليكا (Replika) غالباً ما يطبع المحتوى الضار مثل إيذاء النفس والعنف عند التفاعل مع مجموعات المستخدمين المعرضين لمخاطر عالية.

Prerna Juneja, Lika Lomidze2026-05-04
💬 NLP

Estimating LLM Grading Ability and Response Difficulty in Automatic Short Answer Grading via Item Response Theory

تقدم هذه الورقة إطار عمل يعتمد على نظرية الاستجابة للمفردة (IRT) لتقييم التصحيح التلقائي للإجابات القصيرة القائم على النماذج اللغوية الكبيرة، مما يكشف أن النماذج ذات الدرجات الإجمالية المتشابهة تظهر ملامح متمايزة من المتانة مع زيادة صعوبة الاستجابة، وتحدد خصائص لغوية ودلالية محددة ترتبط بأخطاء التصحيح.

Longwei Cong, Sonja Hahn, Sebastian Gombert, Leon Camus, Hendrik Drachsler, Ulf Kroehne2026-05-04
⚡ electrical engineering

Alethia: A Foundational Encoder for Voice Deepfakes

تقدم هذه الورقة البحثية "أليثيا" (Alethia)، وهو مشفر صوتي تأسيسي مبتكر يتفوق على نماذج الكلام التأسيسية الحالية في كشف التزييف العميق للصوت وتحديد موقعه، وذلك من خلال استخدام وصفة تدريب مسبق تجمع بين التنبؤ بالتمثيل المضمن ذي عنق الزجاجة وإعادة بناء المخطط الطيفي القائم على مطابقة التدفق، مما يحقق متانة فائقة وتعميماً صفري القدرة عبر مختلف المهام والمجالات.

Yi Zhu, Brahmi Dwivedi, Jayaram Raghuram, Surya Koppisetti2026-05-04
💬 NLP

Retrieval-Augmented Reasoning for Chartered Accountancy

تقدم الورقة البحثية إطار عمل CA-ThinkFlow، وهو إطار عمل لتوليد معزز بالاسترجاع وفعال في استخدام المعلمات، يستخدم نموذج استدلال بقدر 14 مليار معلمة مكمّم واستخراج مستندات مدرك للتخطيط لمعالجة تحديات الموثوقية في محاسبة المحاسبين القانونيين الهندية، محققاً أداءً يضاهي النماذج المملوكة الرائدة على مقياس CA-Ben بينما لا يزال يعاني في الاستدلال التنظيمي المعقد في مجال الضرائب.

Jatin Gupta, Akhil Sharma, Saransh Singhania, Ali Imam Abidi2026-05-04
💬 NLP

How Language Models Process Out-of-Distribution Inputs: A Two-Pathway Framework

تكشف هذه الورقة أن طرق كشف البيانات خارج التوزيع (OOD) ذات الصندوق الأبيض الحالية للنماذج اللغوية تعاني من خلط بنيوي بسبب طول التسلسل، وتقترح إطار عمل ثنائي المسار يميز بين الإشارات القائمة على التضمين لتحولات المفردات وبين سمات مسار الحالة الخفية للكشف عن مدخلات النوايا المستترة مثل عمليات الاختراق (jailbreaks).

Hamidreza Saghir2026-05-04
💬 NLP

Are You the A-hole? A Fair, Multi-Perspective Ethical Reasoning Framework

تقترح هذه الورقة إطار عمل عصبياً-رمزياً يجمع بين النماذج اللغوية وحلالات مشكلات الإرضاء الأقصى الموزون (MaxSAT) لتجميع الأحكام الأخلاقية المتضاربة باللغة الطبيعية في أحكام منطقية متسقة، مما يظهر أداءً فائقاً على طريقة التصويت بالأغلبية في مجموعة بيانات r/AmItheAsshole.

Sheza Munir, Ahanaf Rodoshi, Sumin Lee, Feiran Chang, Xujie Si, Syed Ishtiaque Ahmed2026-05-04
🤖 machine learning

Borrowed Geometry: Computational Reuse of Frozen Text-Pretrained Transformer Weights Across Modalities

تُثبت هذه الورقة أن أوزان نموذج Gemma 4 31B المدربة مسبقاً والمجمدة والمقتصرة على النصوص يمكن نقلها بفعالية عبر الوسائط المتعددة لتحقيق أداء يضاهي أحدث ما توصل إليه العلم في مهام التحكم الروبوتي، واتخاذ القرار، والاستدعاء الترابطي باستخدام واجهة تدريبية رقيقة فقط، مما يثبت أن قدرة الأوزان في النموذج على تحمل عبء التدريب المسبق هي قدرة جوهرية متأصلة في أوزانه وليست مرتبطة بوسيطه المحدد أو بيانات تدريبه.

Abay Bektursun2026-05-04