💬 NLP

Building Autonomous GUI Navigation via Agentic-Q Estimation and Step-Wise Policy Optimization

تقدم هذه الورقة إطار عمل جديداً متمحوراً حول نماذج اللغات الكبيرة متعددة الوسائط (MLLM) لوكلاء واجهة المستخدم الرسومية (GUI) المستقلين، يجمع بين تقدير (agentic-Q) وتحسين السياسة خطوة بخطوة لتمكين جمع البيانات ذاتي التوليد بكفاءة وتعزيز التعلم المستقر، مما سمح لنموذج Ovis2.5-9B بالتفوق على المنافسين الأكبر حجماً في اختبارات الملاحة والتمركز.

Yibo Wang, Guangda Huzhang, Yuwei Hu, Yu Xia, Shiyin Lu, Qing-Guo Chen, Zhao Xu, Weihua Luo, Kaifu Zhang, Lijun Zhang2026-02-17
💬 NLP

Metaphors' journeys across time and genre: tracking the evolution of literary metaphors with temporal embeddings

تستخدم هذه الدراسة الدلالات التوزيعية عبر الزمن (diachronic distributional semantics) على مدونات لغوية إيطالية للكشف عن أنه بينما ظلت متطلبات المعالجة للاستعارات الأدبية مستقرة بمرور الوقت، فإن النوع الأدبي يؤثر بشكل كبير على صعوبة الاستعارة، حيث تقدم الأدب الحديث تكاليف معالجة أعلى، بينما توفر لغة الويب المعاصرة سهولة وصول أكبر مقارنة بنظيراتها من القرن التاسع عشر.

Veronica Mangiaterra, Chiara Barattieri di San Pietro, Paolo Canal, Valentina Bambini2026-02-17
💬 NLP

Beyond Words: Evaluating and Bridging Epistemic Divergence in User-Agent Interaction via Theory of Mind

تعالج هذه الورقة الفجوة بين معتقدات المستخدم والحالات البيئية في تفاعلات النماذج اللغوية الكبيرة من خلال صياغة "نظرية العقل" كآلية لحل التباين المعرفي، مقدمةً معياراً جديداً ونموذجاً مدرباً بالتعلم التعزيزي يحسن أداء المهام بشكل كبير من خلال تعزيز تتبع المعتقدات والاستدلال.

Minyuan Ruan, Ziyue Wang, Kaiming Liu, Yunghwei Lai, Peng Li, Yang Liu2026-02-17
💬 NLP

Evaluating Prompt Engineering Techniques for RAG in Small Language Models: A Multi-Hop QA Approach

تقدم هذه الورقة دراسة تجريبية واسعة النطاق تُظهر أن تحسين تقنيات هندسة الأوامر يعزز بشكل كبير أداء الاستدلال متعدد الخطوات في النماذج اللغوية الصغيرة ضمن أنظمة التوليد المعزز بالاسترجاع، محققةً مكاسب تصل إلى 84.5% على مجموعة بيانات HotpotQA مقارنة بالأساليب القياسية.

Amir Hossein Mohammadi, Ali Moeinian, Zahra Razavizade, Afsaneh Fatemi, Reza Ramezani2026-02-17
💬 NLP

Pre-Editorial Normalization for Automatically Transcribed Medieval Manuscripts in Old French and Latin

تقدم هذه الورقة مهمة "التطبيع ما قبل التحريري" (PEN) لسد الفجوة بين الطبعات الرقمية الدقيقة باليوجرافيا (الخطوط القديمة) والمطبعة للغة الفرنسية القديمة واللاتينية، حيث تقدم مجموعة بيانات جديدة ونموذجاً قائماً على ByT5 يحقق أداءً هو الأفضل في فئته في تحويل مخرجات التعرف الآلي على النصوص الخام إلى نصوص مطبعة قابلة للاستخدام.

Thibault Clérice, Rachel Bawden, Anthony Glaise, Ariane Pinche, David Smith2026-02-17
💬 NLP

MarsRetrieval: Benchmarking Vision-Language Models for Planetary-Scale Geospatial Retrieval on Mars

تقدم هذه الورقة MarsRetrieval، وهو معيار شامل وبروتوكول موحد مصمم لتقييم وتحسين نماذج الرؤية واللغة للاكتشاف الجيومورفولوجي الموجه بالنصوص على كوكب المريخ، مما يسلط الض pretty الضوء على الحاجة الماسة للضبط الدقيق المتخصص في هذا المجال للتغلب على أوجه القصور في النماذج التأسيسية الحالية في التقاط التمايزات الجيومورفولوجية المريخية.

Shuoyuan Wang, Yiran Wang, Hongxin Wei2026-02-17
💬 NLP

Neuromem: A Granular Decomposition of the Streaming Lifecycle in External Memory for LLMs

تقدم هذه الورقة "نيوروميم" (Neuromem)، وهو منصة اختبار قابلة للتوسع لتقييم وحدات الذاكرة الخارجية للنماذج اللغوية الكبيرة تحت ظروف تدفق متداخلة وواقعية عبر تفكيك دورة حياة الذاكرة إلى خمسة أبعاد رئيسية، كاشفةً أنه في حين تفرض هياكل البيانات جودة الأداء بشكل أساسي، فإن الضغط الشديد والتكامل التوليدي يقدمان مكاسب محدودة في الدقة رغم نقل التكاليف بين الإدراج والاسترجاع.

Ruicheng Zhang, Xinyi Li, Tianyi Xu, Shuhao Zhang, Xiaofei Liao, Hai Jin2026-02-17
💬 NLP

LogitsCoder: Towards Efficient Chain-of-Thought Path Search via Logits Preference Decoding for Code Generation

يُعد LogitsCoder إطار عمل مبتكر يعمل على تحسين كفاءة وجودة توليد الكود من خلال معالجة مشكلات "ضعف التفكير" و"الإفراط في التفكير" عبر آليات تحكم على مستوى الـ logits، وتحديداً من خلال فك التشفير بتفضيل الـ logits واستراتيجيات اختيار المسار، لتوليد سلاسل استدلال متوازنة ومتماسكة.

Jizheng Chen, Weiming Zhang, Xinyi Dai, Weiwen Liu, Kounianhua Du, Yasheng Wang, Ruiming Tang, Yong Yu, Weinan Zhang2026-02-17
💬 NLP

From Scarcity to Scale: A Release-Level Analysis of the Pashto Common Voice Dataset

تقدم هذه الورقة تحليلاً كمياً لمجموعة بيانات "Pashto Common Voice" (الإصدار 24.0) التي تتوسع بسرعة، حيث تسلط الضوء على نموها لتصل إلى ما يقرب من 2,800 ساعة مع تحديد تحديات حرجة مثل التركز الشديد للمساهمين، والخلل في الفئات العمرية، والفجوات الكبيرة في البيانات الوصفية للجنس، والتي يجب معالجتها لتحسين فائدة هذه المجموعة لتقنيات التعرف التلقائي على الكلام.

Jandad Jahani, Mursal Dawodi, Jawid Ahmad Baktash2026-02-17
💬 NLP

Knowing When Not to Answer: Abstention-Aware Scientific Reasoning

تقترح هذه الورقة إطار عمل للتحقق واعياً بالامتناع، يقوم بتفكيك الادعاءات العلمية ويمتنع انتقائياً عن الإجابة عندما تكون الأدلة غير كافية، مما يثبت أن تحديد متى يجب الإجابة أكثر أهمية للموثوقية العلمية من اختيار بنية نموذج محددة.

Samir Abdaljalil, Erchin Serpedin, Hasan Kurban2026-02-17