💬 NLP

FOR-Prompting: From Objection to Revision via an Asymmetric Prompting Protocol

تقدم الورقة البحثية بروتوكول FOR-Prompting، وهو بروتوكول توجيه غير متماثل ومستقل عن النموذج، يعزز الاستدلال والتحسين التكراري عبر مهام متنوعة من خلال هيكلة التفاعلات بين المدافع (Defender)، والسائل (Questioner)، والمضيف (Host) الاختياري، مما يمكن حتى النماذج الصغيرة من تحقيق أداء يضاهي أو يتفوق على الخطوط المرجعية القياسية دون الحاجة إلى تدريب أو الوصول إلى المكونات الداخلية للنموذج.

He Zhang, Anzhou Zhang, Jian Dai2026-03-10
🤖 machine learning

Tree-based Dialogue Reinforced Policy Optimization for Red-Teaming Attacks

تقدم الورقة البحثية DialTree، وهو إطار عمل للتعلم التعزيزي للحوار قائم على الأشجار، يكتشف ذاتياً استراتيجيات هجوم متنوعة وفعالة متعددة الأدوار ضد النماذج اللغوية الكبيرة، متفوقاً بشكل كبير على أساليب الاختبار الأحمر الحالية أحادية الدور أو القائمة على القوالب.

Ruohao Guo, Afshin Oroojlooy, Roshan Sridhar, Miguel Ballesteros, Alan Ritter, Dan Roth2026-03-10
💬 NLP

HypoSpace: Evaluating LLM Creativity as Set-Valued Hypothesis Generators under Underdetermination

تقدم الورقة البحثية HypoSpace، وهي مجموعة أدوات تشخيصية تقيم النماذج اللغوية الكبيرة باعتبارها مولدات فرضيات ذات قيم مجموعات في المجالات العلمية غير محددة المعالم، وذلك عبر قياس الصلاحية، والتفرد، والاسترداد للكشف عن انهيار النمط الذي تفشل مقاييس الصحة التقليدية في رصده.

Tingting Chen, Beibei Lin, Zifeng Yuan, Qiran Zou, Hongyu He, Anirudh Goyal, Yew-Soon Ong, Dianbo Liu2026-03-10
💬 NLP

SwiftEmbed: Ultra-Fast Text Embeddings via Static Token Lookup for Real-Time Applications

يُعد SwiftEmbed نظام تقديم يعتمد على لغة Rust وموجه للإنتاج، ويحقق زمن استجابة فائق الانخفاض (1.12 مللي ثانية p50) وإنتاجية عالية (50,000 طلب في الثانية) للتطبيقات في الوقت الفعلي من خلال استخدام البحث الثابت عن الرموز (static token lookup) وتجميع المتوسط (mean pooling) على نموذج Potion-base-8M المقطر، مما يوفر أداءً قويًا في مهام كشف التكرار والتشابه الدلالي مع التضحية بالدقة في مهام التصنيف والاسترجاع المعقدة مقارنة باستنتاج المحولات (transformer inference) الكامل.

Edouard Lansiaux, Antoine Simonet, Eric Wiel2026-03-10
💬 NLP

HatePrototypes: Interpretable and Transferable Representations for Implicit and Explicit Hate Speech Detection

تقدم هذه الورقة البحثية HatePrototypes، وهي طريقة خالية من المعلمات تستخدم تمثيلات متجهية على مستوى الفئة مشتقة من 50 مثالاً فقط لكل فئة لتمكين الكشف الفعال والقابل للتفسير والقابل للنقل لكل من خطاب الكراهية الصريح والضمني دون الحاجة إلى ضبط دقيق متكرر.

Irina Proskurina, Marc-Antoine Carpentier, Julien Velcin2026-03-10
💬 NLP

SPOT: An Annotated French Corpus and Benchmark for Detecting Critical Interventions in Online Conversations

تقدم هذه الورقة SPOT، وهو أول متن لغوي ومعيار مرجعي فرنسي مُوسّم للكشف عن "نقاط التوقف" (stopping points)—وهي تدخلات حرجة دقيقة توقف أو تعيد توجيه المناقشات عبر الإنترنت—وتُثبت أن نماذج الترميز (encoder models) المضبوطة بدقة تتفوق على النماذج اللغوية الكبيرة (LLMs) التي تعتمد على التلقين في هذه المهمة، لا سيما عندما تُعزز بالبيانات الوصفية السياقية.

Manon Berriche, Célia Nouri, Chloée Clavel, Jean-Philippe Cointet2026-03-10
💬 NLP

Multimodal LLMs Do Not Compose Skills Optimally Across Modalities

تكشف هذه الورقة أن النماذج اللغوية الكبيرة متعددة الوسائط (MLLMs) تعاني في تكوين المهارات بشكل أمثل عبر الوسائط المختلفة، حيث تظهر فجوات كبيرة في الأداء حتى عند استخدام استراتيجيات مثل تسلسل الأفكر (chain-of-thought) والضبط الدقيق المتخصص.

Paula Ontalvilla, Aitor Ormazabal, Gorka Azkune2026-03-10
💬 NLP

Process-Centric Analysis of Agentic Software Systems

تقدم هذه الورقة Graphectory، وهو إطار عمل قائم على الرسوم البيانية لتحليل مسارات التنفيذ العشوائية للأنظمة البرمجية الوكيلية، والذي يكشف أن المطالبات الأكثر ثراءً والنماذج الأقوى تنتج أنماط استدلال أكثر تعقيداً مع تمكين المراقبة والتدخل في الوقت الفعلي، مما يحسن معدلات حل المشكلات والكفاءة بشكل كبير.

Shuyang Liu, Yang Chen, Rahul Krishna, Saurabh Sinha, Jatin Ganhotra, Reyhan Jabbarvand2026-03-10
⚡ electrical engineering

Spoken Conversational Agents with Large Language Models

يستعرض هذا البرنامج التعليمي تطور الوكلاء الحواريين المنطوقين من الأنظمة المتتالية إلى النماذج اللغوية الكبيرة الأصلية في الصوت، مغطياً البنى التقنية، ومجموعات البيانات، ومقاييس التقييم، مع تقديم خارطة طريق عملية ومعالجة التحديات المفتوحة في الخصوصية، والسلامة، والمتانة.

Chao-Han Huck Yang, Andreas Stolcke, Larry Heck2026-03-10
💬 NLP

SETUP: Sentence-level English-To-Uniform Meaning Representation Parser

تقدم هذه الورقة البحثية SETUP، وهو مُحلل للجمل من الإنجليزية إلى تمثيل المعنى الموحد (UMR) على مستوى الجملة، يحقق أداءً هو الأفضل حالياً من خلال الضبط الدقيق لنماذج تمثيل المعنى المجرد (AMR والاستفادة من محولات التبعيات العالمية، مما يتيح الإنتاج الآلي واسع النطاق لرسوم بيانية دقيقة لتمثيل المعنى الموحد (UMR).

Emma Markle, Javier Gutierrez Bach, Shira Wein2026-03-10