💬 NLP

Curriculum Reinforcement Learning from Easy to Hard Tasks Improves LLM Reasoning

تقترح هذه الورقة "E2H Reasoner"، وهي طريقة للتعلم التعزيزي القائم على المنهج الدراسي تقوم بجدولة المهام من السهل إلى الصعب لتحسين قدرات الاستنتاج لدى النماذج اللغوية الصغيرة، مقدمةً بذلك ضمانات تقارب نظرية وأدلة تجريبية على أداء متفوق مقارنة بنهج التعلم التعزيزي القياسية.

Shubham Parashar, Shurui Gui, Xiner Li, Hongyi Ling, Sushil Vemuri, Blake Olson, Eric Li, Yu Zhang, James Caverlee, Dile (…)2026-03-17
💬 NLP

SimLens for Early Exit in Large Language Models: Eliciting Accurate Latent Predictions with One More Token

تقترح الورقة البحثية SimLens، وهو أسلوب خروج مبكر لا يتطلب تدريباً يعمل على تحسين دقة التنبؤ الكامن في النماذج اللغوية الكبيرة من خلال إجراء استكمال خفيف الوزن لرمز واحد (one-token) باستخدام الرمز الابتدائي والرموز المرشحة، مما يمكّن آلية SimExit من تحقيق تسريع كبير مع حد أدنى من فقدان الدقة.

Ming Ma, Bowen Zheng, Zhongqiao Lin, Tianming Yang2026-03-17
💬 NLP

STEMTOX: From Social Tags to Fine-Grained Toxic Meme Detection via Entropy-Guided Multi-Task Learning

تقدم هذه الورقة مجموعة بيانات TOXICTAGS المكونة من 6,300 ميم (meme) مُعلق عليها، والمُثرية بوسوم اجتماعية، وتقترح إطار عمل STEMTOX، وهو إطار تعلم متعدد المهام موجه بالإنتروبيا يستفيد من هذه الوسوم لتحسين الكشف عن الميمات السامة بدقة عالية باستخدام نماذج الرؤية واللغة.

Subhankar Swain, Naquee Rizwan, Vishwa Gangadhar S, Nayandeep Deb, Animesh Mukherjee2026-03-17
💬 NLP

Induction Signatures Are Not Enough: A Matched-Compute Study of Load-Bearing Structure in In-Context Learning

تُظهر هذه الدراسة أنه بينما تنجح تدخلات البيانات الاصطناعية مثل Bi-Induct في تضخيم بصمات استقرائية محددة، إلا أنها تفشل في تحسين أداء التعلم داخل السياق لأنها تخلق آليات موزعة وفائضة بدلاً من الدوائر المركزية الحاملة للأحمال الموجودة في التدريب الطبيعي فقط، مما يثبت أن استحثاث آلية ما ليس كافياً دون ضمان أن تصبح ضرورية سببيّاً للحوسبة.

Mohammed Sabry, Anya Belz2026-03-17
📊 statistics

Slow-Fast Policy Optimization: Reposition-Before-Update for LLM Reasoning

تقدم الورقة البحثية "تحسين السياسة البطيء-السريع" (SFPO)، وهو إطار عمل متوافق مع الأنظمة القائمة يعزز استقرار وكفاءة تدريب الاستنتاج في النماذج اللغوية الكبيرة من خلال تفكيك كل عملية تحديث إلى خطوات داخلية سريعة، وآلية إعادة تموضع للتحكم في الانحراف عن السياسة، وتصحيح بطيء، مما يؤدي إلى التفوق على خوارزمية (GRPO) بعدد أقل من عمليات التوليد وسرعة أكبر في التقارب.

Ziyan Wang, Zheng Wang, Jie Fu, Xingwei Qu, Qi Cheng, Shengpu Tang, Minjia Zhang, Xiaoming Huo2026-03-17
⚡ electrical engineering

Dynamic Stress Detection: A Study of Temporal Progression Modelling of Stress in Speech

تقترح هذه الورقة إطار عمل ديناميكي للكشف عن التوتر يعمل على نمذجة التوتر كظاهرة تتطور زمنياً باستخدام نماذج تسلسلية قائمة على الانتباه المتقاطع وتوصيفات دقيقة مستمدة من الملصقات العاطفية، محققةً تحسينات كبيرة في الدقة على مجموعات بيانات متعددة مقارنة بالنهج الاستاتيكية.

Vishakha Lall, Yisi Liu2026-03-17
💬 NLP

MOSAIC: Multi-agent Orchestration for Task-Intelligent Scientific Coding

تقدم الورقة البحثية MOSAIC، وهو إطار عمل لنموذج لغوي كبير متعدد الوكلاء لا يتطلب تدريباً، يستخدم نموذج (طالب-معلم) ونافذة سياق موحدة لتفكيك مهام البرمجة العلمية المعقدة، وتصحيح الأخطاء ذاتياً، والحد من الهلوسة، متفوقاً بذلك على النهج الحالية في الدقة والمتانة والقابلية للتفسير.

Siddeshwar Raghavan, Tanwi Mallick2026-03-17
⚡ electrical engineering

SAKE: Towards Editing Auditory Attribute Knowledge of Large Audio-Language Models

تقدم هذه الورقة البحثية SAKE، وهو أول معيار لتقييم تحرير معرفة السمات السمعية الإدراكية في النماذج اللغوية الصوتية الكبيرة، والذي يكشف أن الطرق الحالية تعاني من صعوبة في التعميم السمعي والتحرير المتسلسل، بينما يظهر أن الضبط الدقيق لروابط الوسائط يوفر بديلاً أكثر متانة من التحرير المباشر للنماذج اللغوية الكبيرة الأساسية.

Chih-Kai Yang, Yen-Ting Piao, Tzu-Wen Hsu, Szu-Wei Fu, Zhehuai Chen, Ke-Han Lu, Sung-Feng Huang, Chao-Han Huck Yang, Yu- (…)2026-03-17
💬 NLP

VISTA: Verification In Sequential Turn-based Assessment

يُعد VISTA إطار عمل مبتكر يعزز الكشف عن الهلوسة في الحوارات متعددة الأدوار من خلال تفكيك الاستجابات إلى ادعاءات ذرية للتحقق المتسلسل منها مقابل المصادر الموثوقة وسجل المحادثة، مما يؤدي إلى التفوق على المقاييس الحالية وتحسين توافق الملاحظين البشريين.

Ashley Lewis, Andrew Perrault, Eric Fosler-Lussier, Michael White2026-03-17
💬 NLP

Grounded Misunderstandings in Asymmetric Dialogue: A Perspectivist Annotation Scheme for MapTask

تقدم هذه الورقة مخطط تعليق توضيحي من منظور وجهات النظر لمتن (HCRC MapTask)، والذي يلتقط بشكل منفصل تفسيرات المتحدث والمخاطب للكشف عن كيفية قيام التأسيس الظاهري لإخفاء عدم التطابق المرجعي الناتج عن تباينات التعدد، مما يوفر مورداً جديداً وعدسة تحليلية لدراسة سوء الفهم القائم على التأسيد وتقييم النماذج اللغوية الكبيرة في الحوار التعاوني.

Nan Li, Albert Gatt, Massimo Poesio2026-03-17