💬 NLP

Generics in science communication: Misaligned interpretations across laypeople, scientists, and large language models

تكشف هذه الدراسة أن عامة الناس والنماذج اللغوية الكبيرة يفسرون التعميمات العلمية على أنها أكثر قابلية للتعميم ومصداقية مما يراها العلماء، مما يسلط الضوء على مخاطر جسيمة تتعلق بسوء التواصل والإفراط في التعميم في كل من نشر العلوم بوساطة البشر والذكاء الاصطناعي.

Uwe Peters, Andrea Bertazzoli, Jasmine M. DeJesus, Gisela J. van der Velden, Benjamin Chin-Yee2026-02-09
💬 NLP

Learning Rate Scaling across LoRA Ranks and Transfer to Full Finetuning

تقدم هذه الورقة البحثية "التكيف بالتحديث الأقصى" (μ\muA)، وهو إطار نظري يحدد كيفية قياس معدلات التعلم المثلى مع رتبة (LoRA) والتهيئة، مما يمكّن الممارسين من نقل معدلات التعلم المضبوطة من تجارب (LoRA) الفعالة إلى الضبط الدقيق الكامل عبر مهام متنوعة.

Nan Chen, Soledad Villar, Soufiane Hayou2026-02-09
💬 NLP

Steering Safely or Off a Cliff? Rethinking Specificity and Robustness in Inference-Time Interventions

تقدم هذه الورقة إطار عمل لتقييم خصوصية تدخلات وقت الاستدلال في النماذج اللغوية الكبيرة، وتوضح أنه بينما تنجح أساليب التوجيه في التحكم في السلوكيات المستهدفة دون الإضرار بالقدرات العامة، إلا أنها تفشل بشكل حاسم في الحفاظ على المتانة، حيث تزيد غالباً من التعرض للتهديدات الأمنية مثل عمليات كسر الحماية (jailbreaks) في ظل تغير التوزيعات.

Navita Goyal, Hal Daumé2026-02-09
💬 NLP

VowelPrompt: Hearing Speech Emotions from Text via Vowel-level Prosodic Augmentation

يُعد VowelPrompt إطار عمل مرتكزاً على اللسانيات يعمل على تعزيز التعرف على الانفعالات في الكلام القائم على النماذج اللغوية الكبيرة من خلال تحويل الميزات العروضية الدقيقة على مستوى المصوتات إلى أوصاف لغوية طبيعية، وتحسين النموذج عبر إجراء يتكون من مرحلتين: الضبط الدقيق الموجه (SFT) والتعلم المعزز من خلال استرجاع المخطط والمكافأة من السياسة المتدرجة (GRPO) لتحقيق أداء فائق وقابلية للتفسير عبر ظروف متنوعة.

Yancheng Wang, Osama Hanna, Ruiming Xie, Xianfeng Rui, Maohao Shen, Xuedong Zhang, Christian Fuegen, Jilong Wu, Debjyoti (…)2026-02-09
💬 NLP

Judging What We Cannot Solve: A Consequence-Based Approach for Oracle-Free Evaluation of Research-Level Math

تقترح هذه الورقة البحثية "المنفعة القائمة على النتيجة" (Consequence-Based Utility)، وهي طريقة تقييم خالية من الأوراكل (oracle-free) تقيم الحلول الرياضية على مستوى الأبحاث من خلال قياس فعاليتها كأمثلة سياقية لحل مسائل ذات صلة قابلة للتحقق، مما يظهر أداءً فائقاً في التصنيف مقارنة بنماذج المكافأة وحكام النماذج اللغوية الكبيرة الحاليين.

Guijin Son, Donghun Yang, Hitesh Laxmichand Patel, Hyunwoo Ko, Amit Agarwal, Sunghee Ahn, Kyong-Ha Lee, Youngjae Yu2026-02-09
💬 NLP

Lost in Speech: Benchmarking, Evaluation, and Parsing of Spoken Code-Switching Beyond Standard UD Assumptions

تتناول هذه الورقة البحثية أوجه القصور في الإعراب النحوي القياسي للتبديل اللغوي المنطوق من خلال تقديم تصنيف جديد، وهو معيار SpokeBench، ومقياس تقييم FLEX-UD، وإطار عمل DECAP، والتي تثبت مجتمعةً تحسينات كبيرة في الأداء عبر فصل معالجة الظواهر المنطوقة عن التحليل النحوي الجوهري.

Nemika Tyagi, Holly Hendrix, Nelvin Licona-Guevara, Justin Mackie, Phanos Kareen, Muhammad Imran, Megan Michelle Smith (…)2026-02-09
💬 NLP

FMBench: Adaptive Large Language Model Output Formatting

تقدم هذه الورقة FMBench، وهو معيار لتقييم النماذج اللغوية الكبيرة في تنسيق Markdown التكيفي، وتقترح مسار محاذاة خفيف الوزن يجمع بين الضبط الدقيق الخاضع للإشراف والتعلم المعزز لتعزيز الامتثال الهيكلي مع موازنة الدقة الدلالية.

Yaoting Wang, Yun Zhou, Henghui Ding2026-02-09
💬 NLP

RelayGen: Intra-Generation Model Switching for Efficient Reasoning

يُعد RelayGen إطار عمل تشغيلي على مستوى القطع لا يتطلب تدريباً، يقوم بالتبديل ديناميكياً بين النماذج الكبيرة والصغيرة أثناء الاستنتاج بناءً على عدم اليقين في التوليد، مما يقلل زمن الاستجابة بشكل كبير مع الحفاظ على دقة نماذج الاستدلال الكبيرة.

Jiwon Song, Yoongon Kim, Jae-Joon Kim2026-02-09
💬 NLP

AgentCPM-Report: Interleaving Drafting and Deepening for Open-Ended Deep Research

يُعد AgentCPM-Report نظام بحث عميق محلي وخفيف الوزن يستفيد من سياسة "الكتابة كاستدلال" التي تحاكي البشر للتبادل الديناميكي بين الصياغة والتعمق، مما يمكّن النماذج الصغيرة ذات الـ 8 مليارات معلمة من التفوق على الأنظمة الرائدة مغلقة المصدر في إنشاء تقارير ثاقبة.

Yishan Li, Wentong Chen, Yukun Yan, Mingwei Li, Sen Mei, Xiaorong Wang, Kunpeng Liu, Xin Cong, Shuo Wang, Zhong Zhang, Y (…)2026-02-09
💬 NLP

MTQE.en-he: Machine Translation Quality Estimation for English-Hebrew

تقدم هذه الورقة MTQE.en-he، وهو أول معيار متاح للجمهور لتقدير جودة الترجمة الآلية بين اللغتين الإنجليزية والعبرية، وتوضح أن دمج نماذج متعددة واستخدام الضبط الدقيق الموفر للمعلمات يحسن الأداء بشكل كبير في هذا الزوج اللغوي منخفض الموارد.

Andy Rosenbaum, Assaf Siani, Ilan Kernerman2026-02-09