💬 NLP

Can LLMs Automate Fact-Checking Article Writing?

تقدم هذه الورقة البحثية QRAFT، وهو إطار عمل وكيل يعتمد على النماذج اللغوية الكبيرة (LLM) مصمم لأتمتة توليد مقالات التحقق من الحقائق الكاملة من خلال محاكاة سير العمل البشري، وتقييم أدائه من خلال تقييم الخبراء البشريين.

Dhruv Sahnan, David Corney, Irene Larraz, Giovanni Zagni, Ruben Miguez, Zhuohan Xie, Iryna Gurevych, Elizabeth Churchill (…)2026-02-11
💬 NLP

Cochain: Balancing Insufficient and Excessive Collaboration in LLM Agent Workflows

تُعد Cochain إطار عمل للتحفيز التعاوني يعمل على تحسين سير العمل في الأعمال من خلال دمج رسم بياني معرفي متعدد المراحل وشجرة مطالبات، مما يوازن بفعالية بين عمق الاستدلال لسلسلة الأفكب وبين الذكاء الجماعي للأنظمة متعددة الوكلاء مع تقليل تكاليف الرموز (tokens) والتعقيد.

Jiaxing Zhao, Hongbin Xie, Yuzhen Lei, Xuan Song, Zhuoran Shi, Lianxin Li, Shuangxue Liu, Linguo Xie, Haoran Zhang2026-02-11
💬 NLP

Decoding Phone Pairs from MEG Signals Across Speech Modalities

تُظهر هذه الدراسة أن إشارات تخطيط مغناطيسية الدماغ (MEG) يمكنها فك تشفير الأزواج الصوتية بدقة أكبر أثناء إنتاج الكلام الصريح مقارنة بالاستماع السلبي، مع ثبوت فعالية التذبذبات منخفضة التردد والنماذج الخطية المنتظمة مثل "إيلاستيك نت" (Elastic Net) في عملية فك التشفير.

Xabier de Zuazo, Eva Navas, Ibon Saratxaga, Mathieu Bourguignon, Nicola Molinaro2026-02-11
💬 NLP

MAPS: A Multilingual Benchmark for Agent Performance and Security

تُعد MAPS مجموعة معيارية جديدة متعددة اللغات تُقيّم أداء وأمن أنظمة الذكاء الاصطناعي الوكيلية عبر إحدى عشرة لغة من خلال ترجمة المهام من أربعة معايير رئيسية (GAIA، وSWE-Bench، وMATH، وAgent Security)، مما يكشف أن الانتقال من اللغة الإنجليزية إلى لغات أخرى غالباً ما يؤدي إلى تدهور الموثوقية وزيادة المخاطر الأمنية.

Omer Hofman, Jonathan Brokman, Oren Rachmil, Shamik Bose, Vikas Pahuja, Toshiya Shimizu, Trisha Starostina, Kelly Marchi (…)2026-02-11
💬 NLP

Common Objects Out of Context (COOCo): Investigating Multimodal Context and Semantic Scene Violations in Referential Communication

تقدم هذه الورقة مجموعة بيانات "الأشياء الشائعة خارج السياق" (COOCo) للتحقيق في كيفية موازنة نماذج الرؤية واللغة (VLMs) بين سمات الأشياء المحلية وسياق المشهد العالمي عند توليد المراجع، مما يكشف أن النماذج تستخدم السياق بشكل تكيفي بناءً على التطابق الدلالي ومستويات الضجيج.

Filippo Merlo, Ece Takmaz, Wenkai Chen, Albert Gatt2026-02-11
💬 NLP

Inference-Aware Prompt Optimization for Aligning Black-Box Large Language Models

تقدم هذه الورقة إطار عمل IAPO، وهو إطار عمل مبتكر يعمل على تحسين المطالبات واستراتيجيات توسيع الاستدلال (مثل أخذ عينات Best-of-N) بشكل مشترك لتحقيق توافق أفضل بين النماذج اللغوية الكبيرة ذات الصندوق الأسود وتفضيلات المستخدم والميزانيات الحسابية.

Saaduddin Mahmud, Mason Nakamura, Kyle Hollins Wray, Shlomo Zilberstein2026-02-11
💬 NLP

A large-scale pipeline for automatic corpus annotation using LLMs: variation and change in the English consider construction

تقدم هذه الورقة البحثية مسار عمل مكوناً من أربع مراحل وقابلاً للتوسع، يستخدم النماذج اللغوية الكبيرة لأتمتة التوسيم النحوي للمجموعات اللغوية الضخمة، وتثبت فعاليتها من خلال دراسة تاريخية لتكوين الفعل "consider" في اللغة الإنجليزية، والتي تكشف عن أنماط جديدة من التغير اللغوي.

Cameron Morin, Matti Marttinen Larsson2026-02-11
💬 NLP

ReForm: Reflective Autoformalization with Prospective Bounded Sequence Optimization

تُعد ReForm طريقةً للتصيغ الآلي التأملي تعمل على تحسين الدقة الدلالية لترجمة الرياضيات من اللغة الطبيعية إلى عبارات صورية عبر دمج التصحيح الذاتي التكراري مع تقنية تدريب مبتكرة تُسمى "تحسين المتوالية المحدودة الاستشرافي" (PBSO).

Guoxin Chen, Jing Wu, Xinjie Chen, Wayne Xin Zhao, Ruihua Song, Chengxi Li, Kai Fan, Dayiheng Liu, Minpeng Liao2026-02-11
💬 NLP

Evolving Interactive Diagnostic Agents in a Virtual Clinical Environment

تقدم هذه الورقة إطار عمل للتعلم التعزيزي يدرب وكلاء تشخيصيين (DiagAgent) داخل بيئة سريرية محاكية (DiagGym) لإتقان التشخيص التفاعلي متعدد الجولات، متفوقاً بشكل كبير على النماذج اللغوية الكبيرة الحالية في كل من دقة التشخيص والاستدلال السريري.

Pengcheng Qiu, Chaoyi Wu, Junwei Liu, Qiaoyu Zheng, Yusheng Liao, Haowen Wang, Yun Yue, Qianrui Fan, Shuai Zhen, Jian Wa (…)2026-02-11