💬 NLP

InftyThink: Breaking the Length Limits of Long-Context Reasoning in Large Language Models

تقدم InftyThink نموذج استدلال تكراري مع تلخيص وسيط يحول الاستدلال أحادي السياق الطويل إلى عملية ذات تكلفة محدودة، مما يتيح عمق استدلال غير محدود ويحسن الأداء بشكل كبير عبر الاختبارات الرياضية المرجعية دون الحاجة إلى تعديلات هيكلية.

Yuchen Yan, Yongliang Shen, Yang Liu, Jin Jiang, Mengdi Zhang, Jian Shao, Yueting Zhuang2026-02-26
💬 NLP

Toward Safe and Human-Aligned Game Conversational Recommendation via Multi-Agent Decomposition

تقدم الورقة البحثية إطار عمل MATCHA، وهو إطار متعدد الوكلاء يعزز السلامة، والتخصيص، وتغطية الحالات النادرة لأنظمة توصية المحادثات في الألعاب من خلال تفكيك المهام إلى وكلاء متخصصين لتحليل النوايا، والاسترجاع، والتصنيف، والتحكم في المخاطر، مما يتفوق على النماذج المرجعية الحالية في الدقة، وتقليل الانحياز، والدفاع ضد الهجمات العدائية.

Zheng Hui, Xiaokai Wei, Yexi Jiang, Kevin Gao, Chen Wang, Frank Ong, Se-eun Yoon, Rachit Pareek, Michelle Gong2026-02-26
💬 NLP

Refusal Direction is Universal Across Safety-Aligned Languages

تُثبت هذه الورقة أن آليات الرفض في النماذج اللغوية الكبيرة تُظهر عالمية عابرة للغات، حيث يمكن لمتجه اتجاه رفض واحد مستخرج من اللغة الإنجليزية أن يتجاوز بفعالية ضوابط السلامة في 14 لغة أخرى دون الحاجة إلى ضبط دقيق إضافي، مما يكشف عن آلية أساسية مشتركة لعمليات كسر الحماية متعددة اللغات.

Xinpeng Wang, Mingyang Wang, Yihong Liu, Hinrich Schütze, Barbara Plank2026-02-26
💬 NLP

Simple Yet Effective: Extracting Private Data Across Clients in Federated Fine-Tuning of Large Language Models

تُثبت هذه الورقة أن المشاركين "حسن النية" (semi-honest) في تدريب النماذج اللغوية الكبيرة الاتحادية يمكنهم استخراج معلومات تحديد الهوية الشخصية بفعالية من بيانات العملاء الآخرين باستخدام استراتيجيات بسيطة تعتمد على البادئات، مما يكشف عن مخاطر خصوصية جسيمة ويضع معياراً جديداً لتقييم مثل هذه التهديدات في المجال القانوني.

Yingqi Hu, Zhuo Zhang, Jingyuan Zhang, Jinghua Wang, Qifan Wang, Lizhen Qu, Zenglin Xu2026-02-26
💬 NLP

When Style Breaks Safety: Defending LLMs Against Superficial Style Alignment

تكشف هذه الورقة أن أنماط الأسلوب السطحية في المطالبات يمكن أن ترفع معدلات نجاح هجمات كسر الحماية بشكل كبير من خلال استغلال انتباه النموذج اللغوي الكبير للأسلوب وبيانات ضبط التعليمات الخاصة به، وتقترح "SafeStyle"، وهي استراتيجية دفاعية تخفف من هذه الثغرة عبر دمج بيانات تدريب آمنة متوافقة مع توزيع تلك الأنماط الأسلوبية المحددة.

Yuxin Xiao, Sana Tonekaboni, Walter Gerych, Vinith Suriyakumar, Marzyeh Ghassemi2026-02-26
💬 NLP

Probabilistic distances-based hallucination detection in LLMs with RAG

تقترح هذه الورقة طريقة غير خاضعة للإشراف وفعالة للكشف عن الهلوسة في أنظمة التوليد المعزز بالاسترجاع (RAG)، والتي تستفيد من المسافات الاحتمالية بين تضمينات رموز المطالبة والاستجابة لتحقيق أداء يضاهي أحدث ما توصل إليه العلم دون الحاجة إلى تدريب خاص بالمهمة.

Rodion Oblovatny, Alexandra Kuleshova, Konstantin Polev, Alexey Zaytsev2026-02-26
💬 NLP

Mechanistic Indicators of Understanding in Large Language Models

تقترح هذه الورقة إطاراً متدرجاً يدمج نتائج التفسير الآلي مع النظرية الفلسفية للمرافعة بأن النماذج اللغوية الكبيرة تُظهر أشكالاً هرمية متميزة من الفهم — تتراوح من تشكيل الميزات المفاهيمية إلى اكتشاف الدوائر المبدئية — وبذلك تتجاوز الجدالات الثنائية لتأسيس نظرية معرفية مقارنة ومبررة آلياً حول الإدراك الاصطناعي.

Pierre Beckmann, Matthieu Queloz2026-02-26
💬 NLP

Do LLMs Adhere to Label Definitions? Examining Their Receptivity to External Label Definitions

تتقصى هذه الورقة ما إذا كانت النماذج اللغوية الكبيرة تدمج حقاً تعريفات التصنيفات الخارجية أم تعتمد على معرفتها الداخلية، حيث وجدت أنه بينما يمكن لهذه التعريفات أن تحسن الأداء، إلا أن النماذج غالباً ما تعود إلى تمثيلاتها البارامترية، لا سيما في المهام العامة، مع استفادة المهام المتخصصة في مجال معين بشكل أكبر من التوجيه الصريح.

Seyedali Mohammadi, Bhaskara Hanuma Vedula, Hemank Lamba, Edward Raff, Ponnurangam Kumaraguru, Francis Ferraro, Manas Ga (…)2026-02-26
💬 NLP

Incentive-Aligned Multi-Source LLM Summaries

تقدم هذه الورقة البحثية "تلخيص النصوص الصادق" (TTS)، وهو إطار عمل متوافق مع الحوافز يعزز المتانة الواقعية لملخصات النماذج اللغوية الكبيرة متعددة المصادر من خلال تفكيك المسودات إلى ادعاءات ذرية، واستقصاء مواقف المصادر، وتطبيق آلية التنبؤ بالأقران لمكافأة الأمانة المعلوماتية مع تصفية المصادر غير الموثوقة دون الحاجة إلى تسميات توضيحية للحقيقة.

Yanchen Jiang, Zhe Feng, Aranyak Mehta2026-02-26
💬 NLP

Embedding-Based Context-Aware Reranker

تقترح الورقة البحثية إطار عمل EBCAR، وهو إطار لإعادة الترتيب يعتمد على التضمين وخفيف الوزن يستفيد من آلية انتباه هجينة ومعلومات المقطع الهيكلية لتعزيز الاستدلال عبر المقاطع في أنظمة RAG، محققاً دقة وكفاءة متفوقتين مقارنة بالطرق الرائدة على مقياس ConTEB.

Ye Yuan, Mohammad Amin Shabani, Siqi Liu2026-02-26