💬 NLP

FormationEval, an open multiple-choice benchmark for petroleum geoscience

تقدم هذه الورقة البحثية FormationEval، وهو معيار مفتوح للاختيار من متعدد يتكون من 505 سؤالاً عبر سبعة مجالات في علوم الجيولوجيا البترولية، والذي يقيم 72 نموذجاً لغوياً ويكشف أن أفضل النماذج أداءً تحقق دقة تقارب الكمال مع تسليط الضوء على التحديات المستمرة المرتبطة بمجالات محددة وتقليص فجوات الأداء بين النماذج مفتوحة الأوزان والنماذج المغلقة.

Almaz Ermilov2026-02-17
💬 NLP

SYNAPSE: Empowering LLM Agents with Episodic-Semantic Memory via Spreading Activation

تُعد "سينابس" (Synapse) بنية ذاكرة مبتكرة تعزز التفكير طويل الأمد لوكلاء النماذج اللغوية الكبيرة من خلال نمذجة الذاكرة كرسم بياني ديناميكي يعتمد على التنشيط المنتشر، والتثبيط الجانبي، والاضمحلال الزمني، مما يجعلها تتفوق على الأساليب الحالية في المهام المعقدة ذات الطابع الزمني والمتعدد الخطوات.

Hanqi Jiang, Junhao Chen, Yi Pan, Ling Chen, Weihang You, Yifan Zhou, Ruidong Zhang, Andrea Sikora, Lin Zhao, Yohannes A (…)2026-02-17
💬 NLP

RAGExplorer: A Visual Analytics System for the Comparative Diagnosis of RAG Systems

يُعد RAGExplorer نظاماً للتحليلات المرئية مصمماً لمساعدة المطورين على التنقل في فضاء التكوينات المعقد لأنظمة التوليد المعزز بالاسترجاع (RAG) من خلال تمكين المقارنات المنهجية من المستوى الكلي إلى المستوى الجزئي للأداء عبر التصميمات المختلفة والتشخيص التفاعلي لحالات الفشل.

Haoyu Tian, Yingchaojie Feng, Zhen Wen, Haoxuan Li, Minfeng Zhu, Wei Chen2026-02-17
💬 NLP

Human Values in a Single Sentence: Moral Presence, Hierarchies, and Transformer Ensembles on the Schwartz Continuum

تقدم هذه الورقة إطار عمل فعال حوسبياً للكشف عن 19 قيمة بشرية من قيم "شوارتز" المنقحة في جمل إنجليزية مفردة، مما يثبت أن نموذجاً تجميعياً خفيف الوزن ومعززاً بالميزات يتفوق على كل من أساليب البوابات الهرمية والنماذج اللغوية الكبيرة المضبوطة بالتعليمات تحت قيود صارمة لذاكرة وحدة معالجة الرسومات.

Víctor Yeste, Paolo Rosso2026-02-17
💬 NLP

DS@GT at TREC TOT 2025: Bridging Vague Recollection with Fusion Retrieval and Learned Reranking

يعالج نظام DS@GT مهمة TREC Tip-of-the-Tongue من خلال توظيف إطار استرجاع ثنائي المرحلة يدمج الاسترجاع الكثيف الهجين والواعي بالموضوع مع إعادة ترتيب باستخدام Gemini-2.5-flash، محققاً نسبة استدعاء بلغت 0.66 على مجموعة الاختبار.

Wenxin Zhou, Ritesh Mehta, Anthony Miyaguchi2026-02-17
💬 NLP

Endless Terminals: Scaling RL Environments for Terminal Agents

تقدم الورقة البحثية "Endless Terminals"، وهي خط إنتاج ذاتي التشغيل بالكامل يقوم بتوليد آلاف المهام القابلة للتوسع والمخصصة لاستخدام الطرفيات (terminal-use) لتدريب وكلاء التعلم التعزيزي، مما يثبت أن نهج التعلم التعزيزي البسيط على هذه المجموعة من البيانات يحقق مكاسب أداء جوهرية في كل من المعايير الاصطناعية والمعدة بشرياً دون الحاجة إلى هياكل وكيلة معقدة.

Kanishk Gandhi, Shivam Garg, Noah D. Goodman, Dimitris Papailiopoulos2026-02-17
💬 NLP

From Associations to Activations: Comparing Behavioral and Hidden-State Semantic Geometry in LLMs

تُثبت هذه الورقة أن بيانات التشابه السلوكي، ولا سيما المستمدة من مهام الاختيار القسري، يمكنها استعادة وتوقع الهندسة الدلالية للحالات الخفية للنماذج اللغوية الكبيرة بفعالية، مما يشير إلى أن القياسات السلوكية الخارجية تحتفظ بمعلومات جوهرية حول التمثيلات المعرفية الداخلية.

Louis Schiekiera, Max Zimmer, Christophe Roux, Sebastian Pokutta, Fritz Günther2026-02-17
💬 NLP

Zooming without Zooming: Region-to-Image Distillation for Fine-Grained Multimodal Perception

تقترح هذه الورقة البحثية طريقة "تقطير المنطقة إلى الصورة" (Region-to-Image Distillation)، وهي طريقة تُستخدم أثناء مرحلة التدريب لاستيعاب فوائد الإدراك دقيق التفاصيل الناتجة عن عملية "التقريب" (zooming) التكرارية في تمريرة أمامية واحدة لنموذج لغوي كبير متعدد الوسائط، مما يلغي زمن التأخير عند الاستنتاج مع تحقيق أداء رائد في المهام البصرية دقيقة التفاصيل والإدراك متعدد الوسائط العام.

Lai Wei, Liangbo He, Jun Lan, Lingzhong Dong, Yutong Cai, Siyuan Li, Huijia Zhu, Weiqiang Wang, Linghe Kong, Yue Wang, Z (…)2026-02-17
💬 NLP

MAPLE: A Sub-Agent Architecture for Memory, Learning, and Personalization in Agentic AI Systems

تقترح الورقة البحثية MAPLE، وهي بنية وكيل فرعي مبتكرة تفصل بين الذاكرة والتعلم والتخصيص في مكونات متميزة ومتخصصة للتغلب على قيود التكيف لدى وكلاء النماذج اللغوية الكبيرة الحاليين، مما أظهر تحسينات ملحوظة في درجات التخصيص ودمج السمات في معيار MAPLE-Personas.

Deepak Babu Piskala2026-02-17
💬 NLP

General learned delegation by clones

تقدم الورقة البحثية SELFCEST، وهو إطار عمل يستخدم التعلم التعزيزي الوكيل لتدريب نموذج لغوي أساسي على إنشاء وتنسيق نسخ متوازية ذات أوزان متماثلة بشكل ديناميكي، مما يؤدي إلى تحسين كفاءة الدقة مقابل التكلفة والقدرة على التعميم في مهام الاستدلال المعقدة مقارنة بالنماذج أحادية البنية.

Darren Li, Meiqi Chen, Chenze Shao, Fandong Meng, Jie Zhou2026-02-17