💬 NLP

DonorRank: Donor Language Selection for Low-Resource Cross-Lingual Speech Recognition

تقدم الورقة البحثية DonorRank، وهو إطار عمل للتعلم من أجل الترتيب يتنبأ بفعالية بلغات المانح المثلى للتعرف على الكلام عبر اللغات في وضع الصفر (zero-shot) في البيئات منخفضة الموارد، متفوقاً بذلك على القواعد الاستدلالية التقليدية ومقدماً رؤى عملية حول أنماط الانتقال عبر عائلات اللغات الهندية والأفريقية.

Akriti Dhasmana, Aarohi Srivastava, David Chiang2026-08-13
💬 NLP

Principal Trait Analysis: Towards Deriving "Skills" in Human-AI Collaboration

تقدم هذه الورقة تحليل السمات الرئيسية (PTA)، وهو خوارزمية قائمة على البيانات تستخلص تلقائياً أنماط تفاعل فعالة بين الإنسان والذكاء الاصطناعي من آثار الجلسات التعاونية للتنبؤ بنتائج المهام وتوجيه تطوير المهارات، رغم أن قابلية تعميم هذه السمات كمهارات مستديمة تظل سؤالاً مفتوحاً.

Hunter McNichols, Kai Du, Andrew Lan2026-08-13
💬 NLP

Group Alignment-Induced Sycophancy: A Two-Sided Evaluation of Steerable Pluralistic Alignment

تقدم هذه الورقة مفهوم "التملق الناجم عن محاذاة المجموعات" (GAS) لتقييم كيفية تسبب تكييف النماذج اللغوية مع مجموعات ديموغرافية متنوعة، ليس فقط في تحسين محاذاة الآراء، بل وأيضاً في إحداث زيادات غير منتظمة ومحددة لكل مجموعة في السلوك المتملق، مع الحجّة بأن مثل هذه التكييفات يجب أن تُقدم كملفات تعريف متعددة الأبعاد بدلاً من درجات ملاءمة أحادية.

Haokai Zhao, Yunze Xiao, Weihao Xuan, Flora Salim, Benjamin Tag, Aditya Joshi2026-08-13
💬 NLP

Reinforcing Step-level Reasoning for Effective Self-Correction in LLMs

تقترح هذه الورقة إطار عمل "التحسين التفضيلي للخطوات ذات التصحيح الذاتي" (Self-Fix Step-DPO)، وهو إطار تعزيز تعلم ثنائي المراحل يعزز قدرات التصحيح الذاتي للنماذج اللغوية الكبيرة من خلال تقوية الاستدلال على مستوى الخطوة أولاً عبر التحسين التفضيلي، ثم التدريب صراحةً على التحقق من الأخطاء وتصحيحها، محققاً أداءً فائقاً على النماذج المرجعية الحالية.

Vu Duc Anh, Nhat M. Hoang, Do Xuan Long, Cong-Duy Nguyen, Ponhvoan Srey, Luu Anh Tuan2026-08-13
⚡ electrical engineering

Robust Multi-Tier Infant-Centered Audio Understanding with Whisper via Structured Speaker Conditioning

تقدم هذه الورقة نظاماً قوياً لفهم الصوت متعدد المستويات يجمع بين مشفر "ويسبير" (Whisper) مضبوط بدقة باستخدام تقنية "لورا" (LoRA) مع نموذج "ترانسفورمر" (Transformer) مدرك للمتحدث ومشروط بالعائلة، وذلك لتصنيف تسجيلات الرضع الصاخبة التي تمتد ليوم كامل عبر بيئات منزلية متنوعة بفعالية.

Xulin Fan, Jialu Li, Mohammad Nur Hossain Khan, Kexin Hu, Bashima Islam, Mark Hasegawa-Johnson, Nancy L. McElwain2026-08-13
💬 NLP

Easper: An Accessible ASR Pipeline for Language Documentation

تقدم الورقة البحثية "Easper"، وهو مسار عمل متاح ولا يتطلب برمجة (no-code) يُمكّن اللغويين الميدانيين من الضبط الدقيق المتكرر لنماذج التعرف التلقائي على الكلام (ASR) باستخدام موارد سحابية وتوصيفات برنامج (ELAN)، مما يثبت أن إعطاء الأولوية للتسجيلات الغنية معجمياً والمتكررة صوتياً يحل بفعالية مشكلة البداية الباردة (cold-start problem) في توثيق اللغات.

Aso Mahmudi, Ting Dang, Ekaterina Vylomova, Nick Thieberger2026-08-13
💬 NLP

Confucius4-TTS: Transcript-Free Cross-Lingual Zero-Shot TTS with a Learnable Speaker Encoder

يُعد Confucius4-TTS نظاماً متعدد اللغات لتحويل النص إلى كلام بنمط "الصفر محاولة" (zero-shot)، يتيح استنساخ الصوت عبر اللغات دون الحاجة إلى نصوص منسوخة من خلال توظيف بنية مكونة من مرحلتين مع مشفر متحدث قابل للتعلم لاستخراج سمات الطابع الصوتي من تمثيلات الكلام ذات التعلم الذاتي، محققاً وضوحاً عالياً وتشابهاً في نبرة المتحدث عبر 14 لغة.

Huaxuan Wang, Huimin Wang, Ruiyu Zhang, Yingjie Li, Yitao Duan2026-08-13
💬 NLP

Hybrid-Policy Self-Editing for Composable Unstructured Knowledge Editing

تقدم هذه الورقة البحثية "التحرير الذاتي بالسياسة الهجينة" (HPSE)، وهي طريقة تعزز القابلية للتركيب في تحرير المعرفة غير المهيكلة من خلال التقطير الاستباقي للمعرفة من حالة السياق المتميزة للنموذج، وحقن الحقائق المفقودة استراتيجيًا في مسار التدفق الخاص به للتغلب على قيود التعلم السلبي القائم على السياسة المتبعة.

Tianci Liu, Zihan Dong, Tianchun Li, Yi-Chung Chen, Qiming Cao, Xingchen Wang, Shiyang Wang, Zichen Miao, Linjun Zhang (…)2026-08-13
🤖 machine learning

LEMUR: Latent Entropy-aware Multimodal Unlearning via Visual-anchored Reasoning Redirection

تقدم هذه الورقة البحثية إطار عمل LEMUR، وهو إطار عمل للاستدلال لا يتطلب تدريباً، يستفيد من ديناميكيات الإنتروبيا على مستوى الرمز (token) المستحثة بواسطة التعلم المعزز (RL) للكشف عن مسارات الاستدلال الحساسة وإعادة توجيهها في نماذج الاستدلال اللغوية متعددة الوسائط عبر الحقن الكامن المرتكز بصرياً، مما يكبح تسريب الخصوصية بفعالية مع الحفاظ على فائدة النموذج.

Xinhao Zhong, Yuxia Qiao, Junhao Li, Hao Fang, Yi Sun, Bin Chen2026-08-13
💬 NLP

The Wording Effect: Quantifying Two-Way Drift in LLM Benchmark Performance

تقدم هذه الورقة BenchDrift، وهو إطار عمل يقيس كيف تتسبب إعادة الصياغة المحافظة على المعنى لمشكلات الاختبارات المرجعية في تقلبات كبيرة في الأداء في اتجاهين لدى النماذج اللغوية الكبيرة، مما يكشف أن الحساسية تجاه الصياغة تستمر عبر مختلف مستويات قوة النماذج وأن الهشاشة تنبع من صياغات محددة أكثر من كونها ناتجة عن نقاط ضعف فردية في النماذج.

Shailja Thakur, Sungeun An, Chad DeLuca, Hima Patel2026-08-13