🤖 AI

LLMs for Survey Text Analysis - A Performance Comparison Between Humans and GPT-5 on Inductive Content Analysis

تُظهر هذه الدراسة أن نموذج GPT-5.4 يمكنه محاكاة الأداء البشري في التحليل الاستقرائي للمحتوى لاستجابات الاستبيانات، محققاً مستويات توافق تضاهي موثوقية التقييم بين المقيّمين البشر، مما يشير إلى إمكاناته كأداة دعم قابلة للتوسع للبحث النوعي.

Leonardo Bergmann, Renata Gheorghiu, Ana Gvritishvili, Alex Mican, Chris Stewart, Topias Tolonen-Weckström2026-08-25
💬 NLP

All four leading LLMs talk more than they listen to personality-verified synthetic help-seekers

تكشف هذه الورقة أن أربعة من النماذج اللغوية الكبيرة الرائدة تفشل في التمييز بين الباحثين عن المساعدة الاصطناعيين الذين تم التحقق من شخصياتهم في سيناريوهات الأزمات، حيث تُظهر باستمرار إطنابًا مفرطًا وحلًا متسرعًا للمشكلات بدلًا من الإنصات الفعال أو الاستقرار العاطفي.

Pablo A. Fonseca, Raquel Rodríguez-Carvajal, Rafael A. Calvo2026-08-25
💬 NLP

Rank Reversal in Multilingual LLM Judges: A Label-Free Double-Centering Calibrator

تقدم هذه الورقة "المعايرة القائمة على التوافق" (CBC)، وهي أداة معايرة لاحقة خالية من الملصقات مشتقة من تحليل التباين ثنائي الاتجاه (two-way ANOVA)، والتي تقضي على عكس الرتب الناتج عن اللغة في أحكام النماذج اللغوية الكبيرة متعددة اللغات عبر استعادة وإزالة حدود التفاعل الخاصة بالبنية اللغوية، مما يؤدي إلى تحسين اتساق التصنيف والارتباط بالتفضيلات البشرية بشكل كبير دون الحاجة إلى ملصقات حقيقية.

Alhasan Mahmood, Samir Abdaljalil, Hasan Kurban2026-08-25
💬 NLP

Figurative Justice: Detecting metaphors in Hindi judgements with qualitative assessment and transformers

تقدم هذه الورقة مدونة "هيلي مي" (HiLeMe) للاستعارات القانونية باللغة الهندية ونموذج كشف قائم على تقنية "ترانسفورمر" لمعالجة نقص تحليل الاستعارات في النصوص القانونية الهندية ذات الموارد المحدودة، بهدف فك رموز عملية اتخاذ القرار القضائي وتوسيع نطاق أدوات الخطاب القانوني المؤتمت لتشمل لغات هندية أخرى.

Bhumika Bhattacharyya, Shouvik Kumar Guha, Indranil Dutta2026-08-25
💬 NLP

From Exposure to Expectation: Frequency, Surprisal, and Language Across Development in Spanish

تُظهر هذه الدراسة أنه في حين يُعد التكرار المعجمي التراكمي مؤشراً قوياً على وقت اكتساب الأطفال للكلمات الإسبانية، فإن المفاجأة السياقية تفسر بشكل أساسي صعوبات معالجة القراءة لحظة بلحظة لدى البالغين، مما يشير إلى أن هذه العوامل تلعب أدواراً متميزة عبر مراحل مختلفة من التطور اللغوي.

Francisco Portillo López2026-08-25
🤖 AI

Small Reasoning Models are Instruction Followers in Function Calling

تقدم هذه الورقة البحثية إطار عمل "استدعاء الوظائف المتبع للتعليمات" (IFFC)، الذي يفوض منطق استدعاء الوظائف إلى نموذج أصغر يتبع التعليمات لتحقيق دقة ومتانة فائقتين في ظل التكميم مقارنة بالنهج الأصلية أو القائمة على التلقين، لا سيما بالنسبة للنماذج اللغوية الكبيرة الموجهة نحو الاستدلال.

Yalda Taheri, Mohammad Hassan Heydari, Erfan Naaman, Afsaneh Fatemi2026-08-25
💬 NLP

GTA-RAG: Graph-Trajectory-Augmented Reinforcement Learning for Multi-Turn Retrieval-Augmented Reasoning

يقدم هذا البحث GTA-RAG، وهو إطار عمل للتعلم المعزز مدعوم بمسارات الرسوم البيانية، يقوم بتوليف مسارات استعلام وإجابة متعددة القفزات قابلة للتنفيذ من رسوم بيانية لكيانات ومستندات لتوفير إشراف كثيف على مستوى المسار، مما يحسن بشكل كبير كلاً من تغطية سلسلة الأدلة ودقة الإجابة في الاستدلال القائم على الاسترجاع المعزز متعدد الدورات مقارنة بالنماذج المرجعية الحالية القائمة على التعلم المعزز.

Jun Chen, Yongchao Liu, Pengyu Qiu, Jiajun Zheng, Juelu Zhang, Yujie Zeng, Qin Zhang, Ziyue Qiao, Xiao Luo2026-08-25
💬 NLP

Claim-Level Confidence Calibration for Reliable Decision Making with Large Language Models

تقترح هذه الورقة إطار عمل بنظام الصندوق المغلق يعمل على تفكيك استجابات النماذج اللغوية الكبيرة إلى ادعاءات ذرية وتطبيق معايرة لاحقة باستخدام إشارات وقت الاستدلال لتوليد درجات ثقة موثوقة على مستوى الادعاء، مما يتيح اتخاذ قرارات أكثر قابلية للتنفيذ وعمليات تحقق مستهدفة في المجالات عالية المخاطر.

Toghrul Abbasli, Kentaroh Toyoda, Yuan Wang, Li Chen2026-08-25
💬 NLP

Who Pays More for Safety? Measuring the Disparate Cost of Safety Alignment across Languages

تقدم هذه الورقة مقياس "تكلفة السلامة" لتوضيح أن مواءمة السلامة تفرض عقوبات غير متناسبة على اللغات غير الإنجليزية من خلال فقدان أكبر في المنفعة وحماية أضعف مقارنة باللغة الإنجليزية، مما يكشف عن عدم مساواة منهجي في ممارسات السلامة الحالية.

Chanwoong Yoon, Jungsoo Park, Alan Ritter2026-08-25
💬 NLP

Kernel Token Contradiction: a Fast and Principled Approach for LLM Claim Uncertainty Quantification

تقدم الورقة البحثية "تناقض الرمز النواتي" (Kernel Token Contradiction - KTC)، وهي طريقة خفيفة الوزن وفعالة من حيث استهلاك وحدة المعالجة المركزية لقياس عدم اليقين على مستوى الادعاء في مخرجات النماذج اللغوية الكبيرة، والتي تستفيد من تمثيلات الرموز القائمة على النواة وإحصائيات تكرار ويكيبيديا لتحقيق تسريع كبير مقارنة بالنهج الحالية مع الحفاظ على دقة عالية، لا سيما في أنظمة الدقة العالية.

Jérémie Dentan, Alexi Canesse, Mahammed El Sharkawy, Sonia Vanier2026-08-25