💬 NLP

YaRN: Efficient Context Window Extension of Large Language Models

تُعدُّ YaRN طريقةً فعالةً من حيث الحوسبة لتوسيع نافذة السياق للنماذج اللغوية الكبيرة باستخدام تضمينات الموضع الدوارة (RoPE)، وهي تتطلب عدداً أقل بكثير من الرموز وخطوات التدريب مقارنة بالطرق السابقة مع تحقيق أداء متفوق وقدرات استقراء فائقة.

Bowen Peng, Jeffrey Quesnelle, Honglu Fan, Enrico Shippole2026-02-10
💻 computer science

Black Big Boxes: Tracing Adjective Order Preferences in Large Language Models

تتقصى هذه الورقة البحثية كيفية اكتساب النماذج اللغوية الكبيرة لتفضيلات ترتيب الصفات في اللغة الإنجليزية، حيث وجدت أنه بينما تعكس تنبؤاتها بشكل كبير تواتر بيانات التدريب، فإنها تُظهر أيضًا قدرة قوية على التعميم في التراكيب غير المرئية وتستفيد بفعالية من الإشارات السياقية بما يتجاوز مجرد الحفظ البسيط.

Jaap Jumelet, Lisa Bylinina, Willem Zuidema, Jakub Szymanik2026-02-10
💬 NLP

Building Multilingual Datasets for Predicting Mental Health Severity through LLMs: Prospects and Challenges

تقدم هذه الورقة مجموعة بيانات جديدة متعددة اللغات مترجمة إلى ست لغات لتقييم أداء النماذج اللغوية الكبيرة في التنبؤ بشدة الصحة النفسية، مما يكشف عن تباين كبير في الأداء عبر اللغات ويسلط الضوء على المخاطر والفعالية من حيث التكلفة لاستخدام هذه النماذج في السياقات الطبية العالمية.

Konstantinos Skianis, John Pavlopoulos, A. Seza Doğruöz2026-02-10
💬 NLP

RARe: Retrieval Augmented Retrieval with In-Context Examples

تُعد RARe طريقةً تعمل على تعزيز أداء نماذج استرجاع النصوص المعتمدة على المشفر فقط (encoder-only) وقدرتها على التعميم خارج النطاق، وذلك من خلال ضبطها بدقة لاستخدام أزواج الاستعلام والوثائق المتشابهة دلالياً كأمثلة ضمن السياق.

Atula Tejaswi, Yoonsang Lee, Sujay Sanghavi, Eunsol Choi2026-02-10
💬 NLP

Déjà Vu? Decoding Repeated Reading from Eye Movements

تتقصى هذه الورقة ما إذا كان من الممكن لأنماط حركة العين أن تكتشف تلقائياً ما إذا كان القارئ قد صادف نصاً ما من قبل، مقترحةً نماذج ناجحة للتعلم الآلي واستراتيجية تعزيز قائمة على المحاكاة لفهم كيفية تأثير الذاكرة على القراءة المتكررة بشكل أفضل.

Yoav Meiri, Omer Shubi, Cfir Avraham Hadar, Ariel Kreisberg Nitzav, Yevgeni Berzak2026-02-10
💬 NLP

SafeDialBench: A Fine-Grained Safety Evaluation Benchmark for Large Language Models in Multi-Turn Dialogues with Diverse Jailbreak Attacks

يُعد SafeDialBench معياراً مرجعياً جديداً دقيق التفاصيل صُمم لتقييم سلامة النماذج اللغوية الكبيرة في الحوارات متعددة الأدوار من خلال استخدام تصنيف هرمي، واستراتيجيات هجوم متنوعة لكسر الحماية، وإطار تقييم شامل يقيس قدرات الكشف، والتعامل، والاتساق عبر لغات متعددة.

Hongye Cao, Sijia Jing, Yanming Wang, Ziyue Peng, Zhixin Bai, Zhe Cao, Meng Fang, Fan Feng, Boyan Wang, Jiaheng Liu, Tia (…)2026-02-10
💬 NLP

The Geometry of Refusal in Large Language Models: Concept Cones and Representational Independence

تقترح هذه الورقة نهجاً قائماً على التدرج لهندسة التمثيل لتوضيح أن رفض النماذج اللغوية الكبيرة لا يحكمه اتجاه واحد، بل تحكمه "مخاريط مفاهيمية" متعددة الأبعاد، معقدة، ومستقلة وظيفياً.

Tom Wollschläger, Jannes Elstner, Simon Geisler, Vincent Cohen-Addad, Stephan Günnemann, Johannes Gasteiger2026-02-10
💬 NLP

Capacity-Aware Inference: Mitigating the Straggler Effect in Mixture of Experts

للتخفيف من "تأثير المتخلفين عن الركب" (Straggler Effect) الناتج عن عدم توازن توزيع الرموز في نماذج خليط الخبراء (MoE)، تقترح هذه الورقة آليتين تعتمدان على السعة — وهما إسقاط الرموز المدرك للسعة (Capacity-Aware Token Drop) والإسقاط الموسع المدرك للسعة (Capacity-Aware Expanded Drop) — واللتان تعملان على تحسين سرعة الاستدلال واستغلال الخبراء بشكل كبير مع حد أدنى من التأثير على أداء النموذج.

Shwai He, Weilin Cai, Jiayi Huang, Ang Li2026-02-10
💬 NLP

FAID: Fine-Grained AI-Generated Text Detection Using Multi-Task Auxiliary and Multi-Level Contrastive Learning

تقدم الورقة البحثية FAID، وهو إطار عمل للكشف دقيق التفاصيل ومجموعة بيانات جديدة متعددة اللغات مصممة للتمييز بين النصوص المكتوبة بشرياً، والمولدة بواسطة الذكاء الاصطناعي، والنصوص التعاونية بين البشر والذكاء الاصطناعي، مع تحديد عائلة نماذج اللغات الكبيرة (LLM) المستخدمة، وذلك باستخدام تعلم مساعد متعدد المهام وتعلم تبايني متعدد المستويات لتحسين القدرة على التعميم عبر المجالات والنماذج غير المرئية.

Minh Ngoc Ta, Dong Cao Van, Duc-Anh Hoang, Minh Le-Anh, Truong Nguyen, My Anh Tran Nguyen, Yuxia Wang, Preslav Nakov, Sa (…)2026-02-10