💬 NLP

Bayesian Social Deduction with Graph-Informed Language Models

تقدم هذه الورقة إطار عمل هجين يجمع بين نموذج احتمالي مهيكل للاستدلال على المعتقدات ونموذج لغوي كبير للتفاعل اللغوي، مما يمكّن وكيل استنتاج اجتماعي من التفوق على كل من النماذج اللغوية الأكبر واللاعبين البشر في لعبة "أفالون" مع تحقيق معدل فوز بنسبة 67% ضد البشر.

Shahab Rahimirad, Guven Gergerli, Lucia Romero, Angela Qian, Matthew Lyle Olson, Simon Stepputtis, Joseph Campbell2026-04-13
💬 NLP

BEDTime: A Unified Benchmark for Automatically Describing Time Series

تقدم الورقة البحثية BEDTime، وهو معيار موحد يتكون من خمس مجموعات بيانات وثلاثة أنماط لتقييم مدى قدرة النماذج الحديثة على التعرف والتمييز وتوليد أوصاف للسلاسل الزمنية أحادية المتغير، مما يكشف أن نماذج اللغة المخصصة للسلاسل الزمنية أداؤها أقل مقارنة بنماذج الرؤية واللغة، بينما تعاني جميع النهج من ضعف المتانة في مواجهة الواقع.

Medhasweta Sen, Zachary Gottesman, Jiaxing Qiu, C. Bayan Bruss, Nam Nguyen, Tom Hartvigsen2026-04-13
💬 NLP

Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis

تقدم هذه الورقة إطار عمل "إسناد لوجيت الفضاء الجزئي للمهمة" (TSLA) لتحديد مكونات "التعلم داخل السياق" ميكانيكياً إلى مكوني "تمييز المهمة" و"تعلم المهمة" المتميزين، وذلك عبر تحديد رؤوس الانتباه المتخصصة التي تعمل على محاذاة الحالات الخفية مع الفضاءات الجزئية للمهام وتدويرها نحو التنبؤات الصحيحة، على التوالي.

Haolin Yang, Hakaze Cho, Naoya Inoue2026-04-13
💬 NLP

Task Vectors, Learned Not Extracted: Performance Gains and Mechanistic Insight

تقدم هذه الورقة "متجهات المهام المتعلمة" (LTVs) كبديل متفوق ومُدرب مباشرة لمتجهات المهام المستخرجة من أجل التعلم في السياق، مع توفير رؤى ميكانيكية حول كيفية توجيه هذه المتجهات للتنبؤات عبر دوائر انتباه محددة وأنماط انتشار خطي داخل نماذج المحولات (Transformer).

Haolin Yang, Hakaze Cho, Kaize Ding, Naoya Inoue2026-04-13
💬 NLP

Exploiting Web Search Tools of AI Agents for Data Exfiltration

تقيم هذه الورقة بشكل منهجي مدى عرضة النماذج اللغوية الكبيرة لهجمات حقن الأوامر غير المباشرة عبر أدوات البحث عبر الويب، كاشفةً عن ثغرات مستمرة عبر نماذج متنوعة، ومؤكدةً على ضرورة تعزيز التدريب، وإنشاء قواعد بيانات مركزية للتهديدات، وتطوير أطر اختبار موحدة لدمج الأمن في التصميم الجوهري للذكاء الاصطناعي.

Dennis Rall, Bernhard Bauer, Mohit Mittal, Thomas Fraunholz2026-04-13
💬 NLP

LLM4Delay: Flight Delay Prediction via Cross-Modality Adaptation of Large Language Models and Aircraft Trajectory Representation

تقترح الورقة البحثية LLM4Delay، وهو إطار عمل مبتكر يعزز التنبؤ بتأخير الرحلات الجوية من خلال دمج البيانات الملاحية النصية مع تمثيلات مسار الطائرة عبر استراتيجية تكيف عبر الوسائط، وبذلك يتفوق على أنظمة إدارة الحركة الجوية الحالية.

Thaweerath Phisannupawong, Joshua Julian Damanik, Han-Lim Choi2026-04-13
💬 NLP

A Method for Characterizing Disease Progression from Acute Kidney Injury to Chronic Kidney Disease

تستخدم هذه الدراسة بيانات السجلات الصحية الإلكترونية والنمذجة متعددة الحالات لتحديد خمس عشرة حالة سريرية متميزة لما بعد إصابة الكلى الحادة، مما يكشف كيف تؤثر كل من عوامل الخطر الراسخة والجديدة بشكل متفاوت على التطور نحو مرض الكلى المزمن عبر هذه المسارات.

Yilu Fang, Jordan G. Nestor, Casey N. Ta, Jerard Z. Kneifati-Hayek, Chunhua Weng2026-04-13
💬 NLP

SkillFactory: Self-Distillation For Learning Cognitive Behaviors

تقدم SkillFactory طريقة تقطير ذاتي تعيد ترتيب مسارات الاستدلال غير المكتملة الخاصة بالنموذج نفسه لتصبح بيانات ضبط دقيق تحت الإشراف، وذلك لتهيئته لاكتساب مهارات معرفية قوية مثل التحقق والرجوع إلى الوراء أثناء التعلم المعزز اللاحق، مما يؤدي في النهاية إلى تحسين التعميم والمتانة خارج النطاق مقارنة بالأساليب القياسية.

Zayne Sprague, Jack Lu, Manya Wadhwa, Sedrick Keh, Mengye Ren, Greg Durrett2026-04-13
💬 NLP

Overstating Attitudes, Ignoring Networks: LLM Biases in Simulating Misinformation Susceptibility

تخلص هذه الورقة إلى أنه بينما تستطيع النماذج اللغوية الكبيرة محاكاة أنماط البشر في القابلية للتضليل بشكل عام، إلا أنها تبالغ بشكل منهجي في الربط بين الاعتقاد والمشاركة، وتمنح الأولوية بشكل غير متناسب للعوامل الموقفية على حساب الخصائص الشبكية، مما يشير إلى أنها أكثر ملاءمة لتحديد أوجه التباين مع الحكم البشري منها لاستبداله.

Eun Cheol Choi, Lindsay E. Young, Emilio Ferrara2026-04-13
💬 NLP

Mnemis: Dual-Route Retrieval on Hierarchical Graphs for Long-Term LLM Memory

يُعد Mnemis إطار عمل ذاكرة مبتكر يعزز استرجاع النماذج اللغوية الكبيرة (LLM) طويل المدى من خلال دمج بحث النظام-1 السريع القائم على التشابه مع آلية اختيار عالمية هادفة من الأعلى إلى الأسفل للنظام-2 على رسوم بيانية هرمية، محققاً أداءً هو الأفضل حالياً في اختبارات قياس الذاكرة طويلة المدى.

Zihao Tang, Xin Yu, Ziyu Xiao, Zengxuan Wen, Zelin Li, Jiaxi Zhou, Hualei Wang, Haohua Wang, Haizhen Huang, Weiwei Deng (…)2026-04-13