💬 NLP

Learning Chain Of Thoughts Prompts for Predicting Entities, Relations, and even Literals on Knowledge Graphs

تقدم الورقة البحثية RALP، وهو إطار عمل لتعلم التلقين يستفيد من النماذج اللغوية الكبيرة مع تلقينات سلسلة الأفكار المُحسّنة للتنبؤ بالكيانات والعلاقات والمثبتات في الرسوم البيانية للمعرفة، متفوقاً بشكل كبير على النماذج التقليدية القائمة على التضمين في مهام التعميم والاستدلال الخاص بـ OWL دون الحاجة إلى الوصول إلى التدرج.

Alkid Baci, Luke Friedrichs, Caglar Demir, N'Dah Jean Kouagou, Axel-Cyrille Ngonga Ngomo2026-04-15
🤖 machine learning

Do VLMs Truly "Read" Candlesticks? A Multi-Scale Benchmark for Visual Stock Price Forecasting

تقدم هذه الورقة مجموعة بيانات معيارية متعددة المقاييس وإطار تقييم لتقييم قدرة نماذج الرؤية واللغة على تفسير مخططات الشموع اليابانية للتنبؤ بأسعار الأسهم، كاشفةً عن أنه في حين تؤدي هذه النماذج بشكل جيد في الاتجاهات المستمرة، إلا أنها تعاني في السيناريوهات السوقية المعقدة وتظهر قيوداً كبيرة في الاستنتاج الزمني الدقيق.

Kaiqi Hu, Linda Xiao, Shiyue Xu, Ziyi Tang, Mingwen Liu2026-04-15
💬 NLP

InsightFlow: LLM-Driven Synthesis of Patient Narratives for Mental Health into Causal Models

يقدم البحث InsightFlow، وهو إطار عمل مدفوع بالنماذج اللغوية الكبيرة (LLM) يقوم تلقائياً بتوليد رسوم بيانية سببية متوافقة مع نموذج الـ 5P وذات دلالة سريرية من نصوص جلسات العلاج النفسي، مما يظهر تشابهاً هيكلياً ودلالياً مع الصياغات التي يعدها الخبراء البشريون، مع توفير أداة قابلة للتوسع لتعزيز سير عمل صياغة الحالات السريرية.

Shreya Gupta, Prottay Kumar Adhikary, Bhavyaa Dave, Salam Michael Singh, Aniket Deroy, Tanmoy Chakraborty2026-04-15
💬 NLP

Universal NER v2: Towards a Massively Multilingual Named Entity Recognition Benchmark

تقدم هذه الورقة Universal NER v2، وهي مبادرة مستمرة توسع ما قدمه سلفها في عام 2024 لتوفير معايير مرجعية ذهبية ومعيارية للتعرف على الكيانات المسماة عبر مجموعة لغات متعددة اللغات بشكل هائل، مما يعالج ندرة موارد التقييم للنماذج اللغوية متعددة اللغات.

Terra Blevins, Stephen Mayhew, Marek Šuppa, Hila Gonen, Shachar Mirkin, Vasile Pais, Kaja Dobrovoljc, Voula Giouli, Jun (…)2026-04-15
💬 NLP

Teaching LLMs Human-Like Editing of Inappropriate Argumentation via Reinforcement Learning

تقدم هذه الورقة نهجاً للتعلم التعزيزي باستخدام تحسين السياسة النسبية للمجموعة لتدريب النماذج اللغوية الكبيرة على توليد تعديلات شبيهة بالبشر، ومكتفية ذاتياً، ومحافظة على المعنى، تعمل على تحسين ملاءمة الحجة، متفوقة بذلك على النماذج المرجعية الحالية في كل من التقييمات الآلية والبشرية.

Timon Ziegenbein, Maja Stahl, Henning Wachsmuth2026-04-15
💬 NLP

The role of System 1 and System 2 semantic memory structure in human and LLM biases

من خلال نمذجة التفكير بنظامي المستوى الأول والمستوى الثاني كشبكات ذاكرة دلالية، تكشف الدراسة أنه بينما يُظهر البشر اختلافات هيكلية في تقليل الانحياز بين هذين النظامين، تفتقر النماذج اللغوية الكبيرة إلى مثل هذا المعرفة المفاهيمية غير القابلة للاختزال، مما يشير إلى تفاوتات معرفية جوهرية في كيفية تنظيم البشر والآلات للانحياز الضمني.

Katherine Abramski, Giulio Rossetti, Massimo Stella2026-04-15
🤖 AI

RePAIR: Interactive Machine Unlearning through Prompt-Aware Model Repair

تقدم الورقة البحثية RePAIR، وهو إطار عمل مدرك للمطالبات يتيح عملية نسيان تعلم آلي تفاعلية على الأجهزة من خلال السماح للمستخدمين بتوجيه النماذج اللغوية الكبيرة لنسيان معرفة محددة عبر اللغة الطبيعية باستخدام تقنية تلاعب بالتنشيط خالية من التدريب (STAMP) تحقق إزالة شبه كاملة للمعرفة مع الحفاظ على فائدة النموذج.

Jagadeesh Rachapudi, Pranav Singh, Ritali Vatsi, Praful Hambarde, Amit Shukla2026-04-15
💬 NLP

Round-Trip Translation Reveals What Frontier Multilingual Benchmarks Miss

تجادل هذه الورقة بأن المعايير المرجعية متعددة اللغات الحالية تقيس في المقام الأول الاستدلال والاستدعاء بدلاً من الكفاءة اللغوية الحقيقية، وتقترح "ضائع في الترجمة" (LiT)، وهو معيار مرجعي للترجمة عبر الذهاب والإياب يرتبط ارتباطاً وثيقاً بتقييمات المستخدمين مع تجنب الحاجة إلى مراجع بشرية أو حكام أقوى.

Ronald Skorobogat, Ameya Prabhu, Matthias Bethge2026-04-15
💬 NLP

GlotOCR Bench: OCR Models Still Struggle Beyond a Handful of Unicode Scripts

تقدم الورقة البحثية GlotOCR Bench، وهو معيار شامل لتقييم أداء التعرف الضوئي على الحروف (OCR) عبر أكثر من 100 نظام كتابة من أنظمة يونيكود، كاشفةً أن حتى نماذج الرؤية واللغة المتطورة تعاني في التعميم خارج مجموعة صغيرة من أنظمة الكتابة وتعتمد بشكل كبير على تغطية التدريب المسبق بدلاً من الإدراك البصري القوي.

Amir Hossein Kargaran, Nafiseh Nikeghbal, Jana Diesner, François Yvon, Hinrich Schütze2026-04-15
💬 NLP

PolicyLLM: Towards Excellent Comprehension of Public Policy for Large Language Models

تقدم هذه الورقة البحثية PolicyBench، وهو معيار واسع النطاق متعدد الأنظمة لتقييم استيعاب السياسات عبر مستويات الحفظ، والفهم، والتطبيق، وتقترح PolicyMoE، وهو نموذج متخصص من نوع "خليط الخبراء" (Mixture-of-Experts) يُظهر أداءً فائقاً في مهام الاستدلال الهيكلي والمهام المتعلقة بتطبيق السياسات.

Han Bao, Penghao Zhang, Yue Huang, Zhengqing Yuan, Yanchi Ru, Rui Su, Yujun Zhou, Xiangqi Wang, Kehan Guo, Nitesh V Chaw (…)2026-04-15