💬 NLP

When to Ensemble: Identifying Token-Level Points for Stable and Fast LLM Ensembling

تقدم هذه الورقة SAFE، وهو إطار عمل يعزز استقرار وكفاءة تجميع النماذج اللغوية الكبيرة (LLM) للتوليد طويل التنسيق من خلال تجميع النماذج انتقائياً فقط عند رموز محددة حيث يتم تقليل عدم التطابق في الترميز (tokenization) ويكون الإجماع مرتفعاً، مع توظيف شحذ الاحتمالات للحفاظ على الثقة.

Heecheol Yun, Kwangmin Ki, Junghyun Lee, Eunho Yang2026-03-16
💬 NLP

LLM Unlearning with LLM Beliefs

تحدد هذه الورقة "تأثير العصر" (squeezing effect) في طرق نسيان النماذج اللغوية الكبيرة الحالية، حيث تنتقل الكتلة الاحتمالية إلى إعادة صياغات ذات صلة دلالية، وتقترح إطار عمل للتمهيد الذاتي (bootstrapping framework) يستفيد من معتقدات النموذج عالية الثقة الخاصة به لقمع الاستجابات المستهدفة وإعادة صياغاتها بشكل أكثر فعالية مع الحفاظ على الفائدة.

Kemou Li, Qizhou Wang, Yue Wang, Fengpeng Li, Jun Liu, Bo Han, Jiantao Zhou2026-03-16
💬 NLP

Towards Contextual Sensitive Data Detection

تقترح هذه الورقة إطاراً لسياق حساسية البيانات يستفيد من سياق النوع والمجال لتحسين دقة اكتشاف البيانات الحساسة بشكل كبير وتقليل الإيجابيات الكاذبة مقارنة بالأدوات الحالية، كما تم التحقق من ذلك من خلال التجارب ودراسات الحالة من قبل الخبراء.

Liang Telkamp, Madelon Hulsebos2026-03-16
💬 NLP

Multilingual, Multimodal Pipeline for Creating Authentic and Structured Fact-Checked Claim Dataset

تقدم هذه الورقة مساراً شاملاً يستفيد من النماذج اللغوية الكبيرة لبناء مجموعات بيانات للتحقق من الحقائق، مهيكلة ومتعددة اللغات والوسائط باللغتين الفرنسية والألمانية، وذلك عبر تجميع خلاصات (ClaimReview)، واستخراج الأدلة، وتوليد المبررات لمعالجة أوجه القصور في موارد المعلومات المضللة الحالية.

Z. Melce Hüsünbeyi, Virginie Mouilleron, Leonie Uhling, Daniel Foppe, Tatjana Scheffler, Djamé Seddah2026-03-16
💬 NLP

A Longitudinal, Multinational, and Multilingual Corpus of News Coverage of the Russo-Ukrainian War

تقدم هذه الورقة البحثية DNIPRO، وهو متن لغوي متعدد اللغات يضم 246,000 مقال إخباري من خمس دول تغطي الحرب الروسية الأوكرانية، والذي يتميز ببيانات وصفية مشروحة بشرياً حول الموقف، والمشاعر، والتأطير لتمكين الدراسة التجريبية للسرديات الجيوسياسية المتباينة وحروب المعلومات.

Dikshya Mohanty, Taisiia Sabadyn, Jelwin Rodrigues, Chenlu Wang, Abhishek Kalugade, Ritwik Banerjee2026-03-16
💬 NLP

A Decision-Theoretic Formalisation of Steganography With Applications to LLM Monitoring

تقترح هذه الورقة إطاراً نظرياً لاتخاذ القرار للكشف عن الإخفاء الرقمي (steganography) وقياسه في النماذج اللغوية الكبيرة من خلال تقديم مفهوم "معلومات V\mathcal{V} المعممة" و"الفجوة الإخفائية" لقياس عدم تماثل المعلومات بين الوكلاء، مما يتغلب على قيود الطرق الكلاسيكية التي تتطلب توزيعات مرجعية معروفة.

Usman Anwar, Julianna Piskorz, David D. Baek, David Africa, Jim Weatherall, Max Tegmark, Christian Schroeder de Witt, Mi (…)2026-03-16
💬 NLP

Task-Specific Knowledge Distillation via Intermediate Probes

تقدم هذه الورقة البحثية \method{}، وهو إطار عمل لتقطير المعرفة يعمل على تحسين أداء النموذج الطالب في مهام الاستنتاج من خلال تدريب مجسات خفيفة الوزن على الحالات الخفية للمعلم المجمدة لتوليد إشارات إشراف أكثر نقاءً، مما يتجاوز الضجيج وفقدان المعلومات المتأصل في لوغيتات مخرجات المعلم.

Ryan Brown, Chris Russell2026-03-16
💬 NLP

Aligning Language Models from User Interactions

تقترح هذه الورقة طريقة تقطير ذاتي قابلة للتوسع تعمل على محاذاة وتخصيص النماذج اللغوية من خلال الاستفيد من قدرتها المتأصلة على مراجعة الاستجابات بناءً على متابعات المستخدم، مما يثبت أن بيانات التفاعل متعدد الدورات الخام من عمليات النشر في العالم الحقيقي يمكن أن تحسن اتباع التعليمات والتكيف دون الحاجة إلى تغذية راجعة صريحة أو تراجع في القدرات.

Thomas Kleine Buening, Jonas Hübotter, Barna Pásztor, Idan Shenfeld, Giorgia Ramponi, Andreas Krause2026-03-16
🤖 AI

Context-Enriched Natural Language Descriptions of Vessel Trajectories

تقترح هذه الورقة إطار عمل مدركاً للسياق يعمل على تحويل بيانات مسارات السفن الخام المستمدة من نظام التعريف الآلي (AIS) إلى تمثيلات مهيكلة ومثرية دلالياً وموسومة بمعلومات سياقية متعددة المصادر، مما يتيح توليد أوصاف باللغة الطبيعية محكومة بواسطة النماذج اللغوية الكبيرة (LLMs) لتسهيل عمليات الاستدلال والتحليلات البحرية رفيعة المستوى.

Kostas Patroumpas, Alexandros Troupiotis-Kapeliaris, Giannis Spiliopoulos, Panagiotis Betchavas, Dimitrios Skoutas, Dimi (…)2026-03-16
💻 computer science

Multi-Step Semantic Reasoning in Generative Retrieval

تقدم الورقة البحثية ReasonGR، وهو إطار عمل يعزز قدرة نماذج الاسترجاع التوليدي على التعامل مع مهام الاستدلال الرقمي والدلالي المعقدة، مثل الاستعلامات المالية، من خلال توظيف التلقين المهيكل ووحدة تكييف تركز على الاستدلال لتحسين دقة الاسترجاع بشكل كبير.

Steven Dong, Yubao Tang, Maarten de Rijke2026-03-16