⚡ electrical engineering

LASE: Language-Adversarial Speaker Encoding for Indic Cross-Script Identity Preservation

تقدم هذه الورقة البحثية LASE، وهو مشفر متحدث مضاد للغة تم تدريبه باستخدام هدف عكس التدرج للقضاء على تسرب الهوية المعتمد على النص في استنساخ الصوت عبر النصوص المختلفة للغات الهندية، محققاً فجوات أداء تقترب من الصفر عبر مجموعات بيانات اللهجات الغربية والهندية مع تطلب كمية أقل بكثير من بيانات التدريب مقارنة بالنماذج المرجعية الحالية.

Venkata Pushpak Teja Menta2026-05-04
💬 NLP

When LLMs Stop Following Steps: A Diagnostic Study of Procedural Execution in Language Models

تقدم هذه الورقة معياراً تشخيصياً يوضح أنه بينما تحقق النماذج اللغوية الكبيرة دقة عالية في المهام الإجرائية القصيرة، فإن قدرتها على تنفيذ الخوارزميات الخطوية بأمانة تتدهور بشكل كبير مع زيادة التعقيد، مما يكشف أن الأداء القوي في المعايير المرجعية غالباً ما يحجب نقاط ضعف جوهرية في اتباع التعليمات.

Sailesh Panda, Pritam Kadasi, Abhishek Upperwal, Mayank Singh2026-05-04
💬 NLP

MultiBLiMP 1.0: A Massively Multilingual Benchmark of Linguistic Minimal Pairs

تقدم الورقة البحثية MultiBLiMP 1.0، وهو معيار آلي بالكامل ومتعدد اللغات بشكل هائل يضم أكثر من 128,000 زوج أدنى عبر 101 لغة، والذي يقيم قدرات النماذج اللغوية الكبيرة في مطابقة الفعل للفاعل ويكشف عن أوجه قصور كبيرة في نمذجة اللغات ذات الموارد المنخفضة.

Jaap Jumelet, Leonie Weissweiler, Joakim Nivre, Arianna Bisazza2026-05-01
💬 NLP

From Test-taking to Cognitive Scaffolding: A Pedagogical Diagnostic Benchmark for LLMs on English Standardized Tests

تقدم هذه الورقة ESTBook، وهو معيار متعدد الوسائط يضم أكثر من 10,000 سؤال من اختبارات اللغة الإنجليزية المعيارية المعززة بالدعم المعرفي وتبريرات المشتتات، بهدف نقل تقييم النماذج اللغوية الكبيرة من مجرد الدقة البسيطة إلى تشخيص المفاهيم الخاطئة لدى البشر وتحسين الاستدلال التربوي.

Luoxi Tang, Tharunya Sundar, Yuqiao Meng, Shuai Yang, Ankita Patra, Lakshmi Manohar Chippada, Jiqian Zhao, Yi Li, Weiche (…)2026-05-01
💬 NLP

Real-World Doctor Agent with Proactive Consultation through Multi-Agent Reinforcement Learning

تقدم هذه الورقة DoctorAgent-RL، وهو إطار عمل متعدد الوكلاء قائم على التعلم التعزيزي تم تدريبه على مجموعة بيانات طبية جديدة متعددة الحوارات (MTMedDialog)، مما يتيح طرح أسئلة استباقية واستراتيجية لتحقيق معدل تطابق تشخيصي دقيق بنسبة 70%، وبالتالي معالجة أوجه القصور في النماذج الثابتة وتخفيف الضغط على موارد الرعاية الصحية.

Yichun Feng, Jiawei Wang, Lu Zhou, Yikai Zheng, Zhen Lei, Yixue Li2026-05-01
💬 NLP

FinChain: A Symbolic Benchmark for Verifiable Chain-of-Thought Financial Reasoning

تقدم الورقة البحثية FinChain، وهو أول معيار لتقييم تسلسل الأفكار المالي القابل للتحقق والذي يتميز بقوالب رمزية قابلة للتنفيذ آلياً ومقياس CHAINEVAL، الذي يكشف عن قصور كبير في قدرات النماذج اللغوية الكبيرة الحالية في التحليل المالي متعدد الخطوات مع تسليط الضون على إمكانات النماذج المتكيفة مع المجال.

Zhuohan Xie, Daniil Orel, Rushil Thareja, Dhruv Sahnan, Hachem Madmoun, Fan Zhang, Debopriyo Banerjee, Georgi Georgiev (…)2026-05-01
💬 NLP

Vision-Language Models Mistake Head Orientation for Gaze Direction: Nonverbal Conversation Cues

تكشف هذه الورقة أن نماذج الرؤية واللغة تظهر أداءً أقل بكثير من البشر في استنتاج اتجاه نظرة العين لأنها تعتمد بشكل خاطئ على اتجاه الرأس بدلاً من مظهر العين، وهو انحياز يُعزى إلى بيانات التدريب وليس إلى بنية النموذج.

Zory Zhang, Pinyuan Feng, Bingyang Wang, Tianwei Zhao, Suyang Yu, Qingying Gao, Hokin Deng, Ziqiao Ma, Yijiang Li, Dezhi (…)2026-05-01
💬 NLP

Flattery in Motion: Benchmarking and Analyzing Sycophancy in Video-LLMs

تقدم هذه الورقة VISE، وهو أول معيار لتقييم التملق في النماذج اللغوية الكبيرة المرئية (Video-LLMs) من خلال تحليل ميلها للتماشي مع مدخلات المستخدم المضللة على حساب الأدلة البصرية، وتقترح استراتيجيتين لا تعتمدان على التدريب للتخفيف من هذا الانحياز عبر تعزيز التجذر البصري والتدخل أثناء الاستنتاج.

Wenrui Zhou, Mohamed Hendy, Shu Yang, Qingsong Yang, Zikun Guo, Yuyu Luo, Lijie Hu, Di Wang2026-05-01
💬 NLP

PiCSAR: Probabilistic Confidence Selection And Ranking for Reasoning Chains

تقدم الورقة البحثية PiCSAR، وهي طريقة لا تتطلب تدريباً تعمل على تحسين دقة استنتاج النماذج اللغوية الكبيرة من خلال اختيار أفضل توليد للمرشح بناءً على الاحتمالية اللوغاريتمية المشتركة لاستنتاجه وإجابته، محققةً مكاسب أداء كبيرة عبر معايير متنوعة بعدد عينات أقل من الخطوط المرجعية الحالية.

Joshua Ong Jun Leang, Zheng Zhao, Aryo Pradipta Gema, Sohee Yang, Wai-Chung Kwan, Xuanli He, Wenda Li, Pasquale Minervin (…)2026-05-01
💬 NLP

Efficient-DLM: From Autoregressive to Diffusion Language Models, and Beyond in Speed

تقدم هذه الورقة Efficient-DLM، وهو إطار عمل يحول النماذج التنبؤية ذاتية الانحدار سابقة التدريب إلى نماذج لغوية انتشارية عالية الكفاءة من خلال توظيف نمط انتباه قائم على الكتل وقناع رموز يعتمد على الموضع، مما يحقق دقة وإنتاجية متفوقة مقارنة بالنماذج الرائدة الحالية.

Yonggan Fu, Lexington Whalen, Zhifan Ye, Xin Dong, Shizhe Diao, Jingyu Liu, Chengyue Wu, Hao Zhang, Enze Xie, Song Han (…)2026-05-01