💬 NLP

High Accuracy, Less Talk (HALT): Reliable LLMs through Capability-Aligned Finetuning

تقدم الورقة البحثية HALT، وهي طريقة ضبط دقيق متوافقة مع القدرات تعمل على تحسين موثوقية النماذج اللغوية الكبيرة من خلال تدريب النماذج على الامتناع عن توليد المحتوى غير المؤكد، مما يزيد بشكل كبير من الصحة الواقعية عبر مجالات متنوعة مع الحفاظ على توازن قابل للضبط مع اكتمال الاستجابة.

Tim Franzmeyer, Archie Sravankumar, Lijuan Liu, Yuning Mao, Rui Hou, Sinong Wang, Jakob N. Foerster, Luke Zettlemoyer, M (…)2026-02-17
💬 NLP

Improving Data Efficiency for LLM Reinforcement Fine-tuning Through Difficulty-targeted Online Data Selection and Rollout Replay

تقترح هذه الورقة إطار عمل كفؤاً من حيث البيانات للضبط الدقيق بالتعزيز للنماذج اللغوية الكبيرة، يجمع بين اختيار البيانات عبر الإنترنت المستهدف للصعوبة وآلية إعادة تشغيل التدفق (rollout replay) لتقليل التكاليف الحسابية بشكل كبير مع الحفاظ على أداء مماثل لخوارزمية GRPO القياسية.

Yifan Sun, Jingyan Shen, Yibin Wang, Tianyu Chen, Zhendong Wang, Mingyuan Zhou, Huan Zhang2026-02-17
💬 NLP

Enhancing Delta Compression in LLMs via SVD-based Quantization Error Minimization

تقدم الورقة البحثية PrinMix، وهو إطار عمل قائم على أسس رياضية يعمل على تحسين ضغط الفرق القائم على تفكيك القيم المفردة (SVD) للنماذج اللغوية الكبيرة من خلال صياغة التكميم كمسألة برمجة خطية صحيحة واستخدام تصحيح هدف إعادة البناء، مما يتفوق بشكل كبير على الأساليب الحالية في الاختبارات المعيارية الصعبة.

Boya Xiong, Shuo Wang, Weifeng Ge, Guanhua Chen, Yun Chen2026-02-17
💬 NLP

A Pragmatist Robot: Learning to Plan Tasks by Experiencing the Real World

تقدم الورقة البحثية PragmaBot، وهو إطار عمل يُمكّن الروبوتات من تعلم تخطيط المهام من خلال الخبرة الواقعية عبر استخدام نموذج لغوي بصري للتأمل البصري ونظام ذاكرة مزدوج (قصير المدى وطويل المدى) لتحسين معدلات النجاح بشكل تكراري عبر التوليد المعزز بالاسترجاع.

Kaixian Qu, Guowei Lan, René Zurbrügg, Changan Chen, Christopher E. Mower, Haitham Bou-Ammar, Marco Hutter2026-02-17
💬 NLP

SECA: Semantically Equivalent and Coherent Attacks for Eliciting LLM Hallucinations

تقترح هذه الورقة إطار عمل SECA، وهو إطار هجوم تنافسي مبتكر يستحث الهلوسة في النماذج اللغوية الكبيرة من خلال توليد تعديلات على المطالبات تكون واقعية ومتكافئة دلالياً ومتماسكة، مما يتغلب على قيود الأساليب السابقة التي تعتمد على مدخلات غير منطقية أو معدلة دلالياً.

Buyun Liang, Liangzu Peng, Jinqi Luo, Darshan Thaker, Kwan Ho Ryan Chan, René Vidal2026-02-17
💬 NLP

Batch Speculative Decoding Done Right

تحدد هذه الورقة أن تطبيقات فك التشفير الاستباقي بالدفعات الحالية تفشل في الحفاظ على تكافؤ المخرجات بسبب مشكلة الموتر المتعرج (ragged tensor)، وتقترح أول إطار عمل صحيح، EQSPEC، إلى جانب نسخته المحسنة EXSPEC، التي تحقق تحسناً في الإنتاجية يصل إلى 3 أضعاف مع ضمان الصحة الخوارزمية عبر مختلف أزواج النماذج.

Ranran Haoran Zhang, Soumik Dey, Ashirbad Mishra, Hansi Wu, Binbin Li, Rui Zhang2026-02-17
💬 NLP

ArtistMus: A Globally Diverse, Artist-Centric Benchmark for Retrieval-Augmented Music Question Answering

تقدم هذه الورقة ArtistMus، وهو معيار متنوع عالمياً وقاعدة بيانات MusWikiDB المتجهة، واللذين يثبتان أن التوليد المعزز بالاسترجاع يعزز بشكل كبير الدقة الواقعية والاستدلال السياقي في الإجابة على الأسئلة المتعلقة بالموسيقى، مما يمكّن النماذج مفتوحة المصدر من منافسة الأداء المملوك لشركات.

Daeyong Kwon, SeungHeon Doh, Juhan Nam2026-02-17
💬 NLP

Writing in Symbiosis: Mapping Human Creative Agency in the AI Era

تحلل هذه الورقة بيانات كتابية طولية لاقتراح نموذج "التطور ثنائي المسار"، الذي يبرهن على أن الوكالة الإبداعية البشرية تتطور بشكل مشترك مع الذكاء الاصطناعي من خلال أنماط تكيف متنوعة —بما في ذلك التقارب الأسلوبي، والتباعد، والاستقرار— بدلاً من الاستسلام لما يُخشى منه من تجانس التعبير البشري.

Vivan Doshi, Mengyuan Li2026-02-17
💬 NLP

Multi-LLM Thematic Analysis with Dual Reliability Metrics: Combining Cohen's Kappa and Semantic Similarity for Qualitative Research Validation

تقدم هذه الورقة إطار عمل للتحليل الموضوعي متعدد النماذج اللغوية الكبيرة (multi-LLM) يعمل على التحقق من موثوقية البحث النوعي عبر الجمع بين مقياس "كوهين كابا" ومقاييس التشابه الدلالي، مبرهنةً من خلال دراسة حالة لعلاج بالفن النفسي (psychedelic art therapy) أن نهج التجميع باستخدام نماذج Gemini وGPT-4o وClaude يحقق اتفاقاً عالياً بين المقيمين واستخراجاً قوياً للموضوعات المتوافقة.

Nilesh Jain, Hyungil Suh, Seyi Adeyinka, Leor Roseman, Aza Allsop2026-02-17