💬 NLP

StagePilot: A Deep Reinforcement Learning Agent for Stage-Controlled Cybergrooming Simulation

تقدم هذه الورقة StagePilot، وهو وكيل تعلم تعزيزي عميق غير متصل (offline) يحاكي التدرج المرحلي للاستدراج الإلكتركي لأغراض الوقاية التعليمية، مُظهرًا من خلال تقييمات قائمة على النماذج اللغوية الكبيرة أن تكوين IQL+AWAC الخاص به يوازن بفعالية بين التقدم في الأهداف الاستراتيجية والتماسك العاطفي لتوليد حوارات تدريبية واقعية.

Heajun An, Qi Zhang, Minqian Liu, Xinyi Zhang, Sang Won Lee, Lifu Huang, Pamela J. Wisniewski, Jin-Hee Cho2026-02-06
💬 NLP

Locas: Your Models are Principled Initializers of Locally-Supported Parametric Memories

تقدم هذه الورقة Locas، وهو نوع جديد من الذاكرة البارامترية المدعومة محلياً يجسّر الفجوة بين التدريب أثناء الاختبار والتعلم المستمر من خلال السماح بالتفريغ المرن أو التكامل الدائم في معلمات النموذج، حيث يضمن التهيئة المبدئية القائمة على أسس سليمة سرعة التقارب، والاحتفاظ الفعال بالمعرفة، وتقليل النسيان الكارثي بأقل قدر من المعلمات الإضافية.

Sidi Lu, Zhenwen Liang, Dongyang Ma, Yan Wang, Haitao Mi, Dong Yu2026-02-06
💬 NLP

Aligning Large Language Model Behavior with Human Citation Preferences

تتقصى هذه الدراسة عدم التوافق بين سلوكيات الاستشهاد لدى النماذج اللغوية الكبيرة وتفضيلات البشر من خلال بناء مجموعة بيانات دقيقة تكشف عن إفراط النماذج في الاستشهاد بعلامات المصدر الصريحة مقابل نقص استشهادها بالكيانات الرقمية والمسماة، وتُبين أن تحسين التفضيل المباشر يمكن أن يعاير هذا السلوك بفعالية ليتطابق بشكل أفضل مع التوقعات البشرية.

Kenichiro Ando, Tatsuya Harada2026-02-06
💬 NLP

Quantifying the Knowledge Proximity Between Academic and Industry Research: An Entity and Semantic Perspective

تُحدد هذه الدراسة كمياً مدى التقارب المعرفي دقيق التفاصيل بين الأوساط الأكاديمية والصناعية من خلال تحليل تداخل الكيانات والتقارب الدلالي عبر تقنيات التعلم الآلي المتقدمة، مما يكشف عن اتجاه متصاعد في التكيف ثنائي الاتجاه وضعف هيمنة الأكاديميا المعرفية خلال التحولات في النماذج التكنولوجية.

Hongye Zhao, Yi Zhao, Chengzhi Zhang2026-02-06
💬 NLP

CoPE: Clipped RoPE as A Scalable Free Lunch for Long Context LLMs

تقدم الورقة البحثية CoPE، وهي طريقة تبسيطية تطبق التقطيع الناعم (soft clipping) على المكونات منخفضة التردد لتمثيلات الموضع الدورانية (RoPE) لتوحيد التخفيف من آثار البيانات خارج النطاق (out-of-distribution) والنمذجة الدلالية، مما يحقق أداءً فائقاً في تعميم الطول للنماذج اللغوية الكبيرة يصل إلى طول سياق يبلغ 256 ألف توكن.

Haoran Li, Sucheng Ren, Alan Yuille, Feng Wang2026-02-06
💬 NLP

Length-Unbiased Sequence Policy Optimization: Revealing and Controlling Response Length Variation in RLVR

تقدم هذه الورقة البحثية خوارزمية "تحسين سياسة التسلسل غير المنحاز للطول" (LUSPO)، وهي خوارزمية جديدة تُحلل وتُصحح نظرياً انحياز الطول في "تحسين سياسة تسلسل المجموعة" (GSPO) لمنع انهيار طول الاستجابة، مما يحقق أداءً هو الأفضل من نوعه في مهام الاستدلال الرياضي ومتعدد الوسائط.

Fanfan Liu, Youyang Yin, Peng Shi, Siqi Yang, Zhixiong Zeng, Haibo Qiu2026-02-06
💬 NLP

Hybrid Gated Flow (HGF): Stabilizing 1.58-bit LLMs via Selective Low-Rank Correction

تقدم هذه الورقة البحثية تدفق البوابة الهجين (HGF)، وهو بنية ثنائية المسار تجمع بين عمود فقري ثلاثي بنظام 1.58 بت مع مسار تصحيح منخفض الرتبة قابل للتعلم لاستعادة جودة النماذج اللغوية الكبيرة المنشورة على الحواف بشكل كبير، مع الحفاظ على استقرار التدريب وتحمل حد أدنى فقط من عبء الذاكرة الإضافي.

David Alejandro Trejo Pizzo2026-02-06
💬 NLP

Cross-Lingual Empirical Evaluation of Large Language Models for Arabic Medical Tasks

تثبت هذه الدراسة تجريبياً أن النماذج اللغوية الكبيرة تظهر فجوة أداء مستمرة ومعتمدة على التعقيد بين اللغتين الإنجليزية والعربية في المهام الطبية، مدفوعة بمشكلات هيكلية في التجزئة (tokenization) ومقاييس ثقة غير موثوقة، مما يسلط الض الضوء على الحاجة الملحة لاستراتيجيات تصميم وتقييم تراعي الخصائص اللغوية.

Chaimae Abouzahir, Congbo Ma, Nizar Habash, Farah E. Shamout2026-02-06
💬 NLP

BhashaSetu: Cross-Lingual Knowledge Transfer from High-Resource to Extreme Low-Resource Languages

تقدم الورقة البحثية طريقة GETR، وهي طريقة مبتكرة لتمثيل الرموز المعززة بالرسوم البيانية (Graph-Enhanced Token Representation) تستفيد من الشبكات العصبية الرسومية لتتفوق بشكل كبير على النماذج المرجعية الحالية في نقل المعرفة عبر اللغات لمهام مستوى الجملة ومستوى الكلمة في اللغات ذات الموارد الشحيحة للغاية، محققة مكاسب أداء جوهرية في وسم أجزاء الكلام، وتصنيف المشاعر، والتعرف على الكيانات المسماة.

Subhadip Maji, Arnab Bhattacharya2026-02-06
💬 NLP

AI chatbots versus human healthcare professionals: a systematic review and meta-analysis of empathy in patient care

تكشف هذه المراجعة المنهجية والتحليل التلوي لـ 15 دراسة (2023–2024) أن روبوتات الدردشة المدعومة بالذكاء الاصطناعي التي تستخدم نماذج لغوية كبيرة تُعتبر أكثر تعاطفاً بشكل ملحوظ من المتخصصين في الرعاية الصحية البشر في التفاعلات القائمة على النصوص، رغم أن النتائج محدودة بسبب غياب الإشارات غير اللفظية والاعتماد على المقيمين بالنيابة.

Alastair Howcroft, Amber Bennett-Weston, Ahmad Khan, Joseff Griffiths, Simon Gay, Jeremy Howick2026-02-06