💬 NLP

Towards Orthographically-Informed Evaluation of Speech Recognition Systems for Indian Languages

تقترح هذه الورقة إطار تقييم مستنداً إلى المعلومات الإملائية (OIWER) يستفيد من النماذج اللغوية الكبيرة لمعالجة تحديات الاختلافات الإملائية في اللغات الهندية، مما يثبت أنه يوفر تقييماً أكثر دقة وتوافقاً مع التقييم البشري لأداء التعرف على الكلام مقارنة بالمقاييس التقليدية مثل معدل خطأ الكلمات.

Kaushal Santosh Bhogale, Tahir Javed, Greeshma Susan John, Dhruv Rathi, Akshayasree Padmanaban, Niharika Parasa, Mitesh (…)2026-03-03
💬 NLP

S-VoCAL: A Dataset and Evaluation Framework for Inferring Speaking Voice Character Attributes in Literature

تقدم هذه الورقة البحثية S-VoCAL، وهي أول مجموعة بيانات وإطار تقييم مصمم لتقييم استنتاج سمات صوت الشخصيات الخيالية من الأدب، مما يثبت من خلال مسار التوليد المعزز بالاسترجاع أنه بينما يمكن استنتاج سمات مثل العمر والجنس بشكل موثوق، تظل سمات أخرى مثل الأصل والحالة الصحية البدنية تشكل تحدياً.

Abigail Berthe-Pardo, Gaspard Michel, Elena V. Epure, Christophe Cerisara2026-03-03
💬 NLP

Stabilizing Policy Optimization via Logits Convexity

تحدد هذه الورقة كون تقعر خسارة (SFT) بالنسبة لـ (logits) النموذج عاملاً رئيسياً في استقرار التدريب، وتقترح تحسين الـ (Logits) المحدب (LCO)، وهو إطار عمل جديد يحاكي هذه الخاصية لاستقرار وتحسين تدريب التعلم المعزز مقارنة بالطرق التقليدية مثل (PPO).

Hongzhan Chen, Tao Yang, Yuhua Zhu, Shiping Gao, Xiaojun Quan, Ting Yao2026-03-03
💬 NLP

Thoth: Mid-Training Bridges LLMs to Time Series Understanding

تقدم هذه الورقة البحثية "ثوث" (Thoth)، وهي أول عائلة من النماذج اللغوية الكبيرة متوسطة التدريب التي تستفيد من مجموعة بيانات "كتاب ثوث" (Book-of-Thoth) عالية الجودة لجسّر الفجوة بين اللغة الطبيعية وبيانات السلاسل الزمنية، مما يعزز بشكل كبير من الاستدلال الزمني والأداء في الاختبارات المعيارية كثيفة المعرفة مقارنة بالنماذج الحالية.

Jiafeng Lin, Yuxuan Wang, Jialong Wu, Huakun Luo, Zhongyi Pei, Jianmin Wang2026-03-03
💬 NLP

Semantic XPath: Structured Agentic Memory Access for Conversational AI

تقترح هذه الورقة البحثية "Semantic XPath"، وهي وحدة ذاكرة ذات بنية شجرية تتفوق بشكل كبير على النماذج المرجعية القائمة على الـ RAG المسطح، وتخفض استهلاك الرموز (tokens) بشكل جذري مقارنة بالذاكرة القائمة على السياق، مما يتيح أنظمة ذكاء اصطنا-ي محادثية موجهة للمهام طويلة الأمد أكثر كفاءة وقابلية للتوسع.

Yifan Simon Liu, Ruifan Wu, Liam Gallagher, Jiazhou Liang, Armin Toroghi, Scott Sanner2026-03-03
💬 NLP

A Unified Framework to Quantify Cultural Intelligence of AI

تقترح هذه الورقة إطاراً موحداً ومبنياً على أسس منهجية يستند إلى نظرية القياس لتعريف الذكاء الثقافي لأنظمة الذكاء الاصطناğı وتشغيله وتقييمه بشكل منهجي، وذلك عبر فصل المفهوم الجوهري عن عملية قياسه ومعالجة التحديات الرئيسية في جمع البيانات، واستراتيجيات الاستقصاء، ومقاييس التقييم.

Sunipa Dev, Vinodkumar Prabhakaran, Rutledge Chin Feman, Aida Davani, Remi Denton, Charu Kalia, Piyawat L Kumjorn, Madhu (…)2026-03-03
💬 NLP

XAI-enhanced Comparative Opinion Mining via Aspect-based Scoring and Semantic Reasoning

تقدم هذه الورقة XCom، وهو نموذج قائم على المحولات (transformer) قابل للتفسير يجمع بين التنبؤ بالتقييم القائم على الجوانب والاستدلال الدلالي وتفسيرات شابلي المضافة لتعزيز الثقة والأداء في تنقيب الآراء المقارنة.

Ngoc-Quang Le, T. Thanh-Lam Nguyen, Quoc-Trung Phu, Thi-Phuong Le, Duy-Cat Can, Hoang-Quynh Le2026-03-03
💬 NLP

Generative AI & Fictionality: How Novels Power Large Language Models

تجادل هذه الورقة بأن الروايات تشكل مخرجات الذكاء الاصطناي التوليدي بشكل كبير من خلال توفير أنماط لغوية غنية تستغلها النماذج لمحاكاة الظواهر الاجتماعية والتواصلية، مما يستوجب على التحليل الثقافي الآن مراعاة تأثير بيانات التدريب الحوسبية.

Edwin Roland, Richard Jean So2026-03-03
💬 NLP

Self-Anchoring Calibration Drift in Large Language Models: How Multi-Turn Conversations Reshape Model Confidence

تقدم هذه الورقة وتثبت تجريبياً ظاهرة "انزياح المعايرة ذاتي الارتكاز" (SACD)، حيث تتسبب المحادثات متعددة الأدوار في جعل النماذج اللغوية الكبيرة تظهر تحولات متباينة في الثقة وأخطاء المعايرة — تتراوح بين انخفاض الثقة وزيادة الخطأ في نموذج Claude Sonnet 4.6، إلى كبح التحسينات الطبيعية في المعايرة في نموذج Gemini 3.1 Pro، وزيادة الإفراط في الثقة في نموذج GPT-5.2 — مما يثبت أن الارتكاز الذاتي التكراري يعيد تشكيل موثوقية النماذج بشكل جذري عبر البنى الهيكلية المختلفة.

Harshavardhan2026-03-03
💬 NLP

Linking Knowledge to Care: Knowledge Graph-Augmented Medical Follow-Up Question Generation

تقدم هذه الورقة البحثية KG-Followup، وهو نموذج لغوي كبير معزز برسم بياني للمعرفة يستفيد من الخبرة الطبية المهيكلة لتوليد أسئلة متابعة عالية الجودة لما قبل التشخيص، متفوقاً على الأساليب الرائدة الحالية بنسبة تتراوح بين 5% إلى 8% في الاستدعاء.

Liwen Sun, Xiang Yu, Ming Tan, Zhuohao Chen, Anqi Cheng, Ashutosh Joshi, Chenyan Xiong2026-03-03