💬 NLP

PQR: A Framework to Generate Diverse and Realistic User Queries that Elicit QA Agent Failures

تقدم الورقة البحثية إطار عمل PQR، وهو إطار تكراري يجمع بين تحسين الاستعلام وتحسين التلقين لتوليد استعلامات مستخدم متنوعة وواقعية تلقائياً تعمل بفعالية على استثارة وكشف الإخفاقات في وكلاء الأسئلة والأجوبة القائمين على النماذج اللغوية الكبيرة، متفوقاً بشكل كبير على الطرق السابقة في اكتشاف الاستجابات غير المفيدة.

Yunan Lu, Luigi Liu, Omar Yahia, Arpit Sharma, Zhou Yu2026-05-19
💬 NLP

Scaling Accessible Mathematics on arXiv: HTML Conversion and MathML 4

تُقدم هذه الورقة تقريراً عن تقدم مبادرة أوراق arXiv بـ HTML التجريبية للفترة 2025-2026، مع تسليط الضوء على تحسينات الدقة المدفوعة من المجتمع، وجهود التحويل على نطاق المتن الكامل، وإدخال MathML 4 لتعزيز إمكانية الوصول، ونقل نسخة من LaTeXML إلى لغة Rust لتعزيز الأداء وخفض التكاليف.

Deyan Ginev, Brian Caruso, Bruce Miller, Jeff Sank, Jacob Weiskoff2026-05-19
💬 NLP

Beyond Sentiment Classification: A Generative Framework for Emotion Intensity Evaluation in Text

تقترح هذه الورقة إطاراً توليدياً مبتكراً ينقل تحليل العواطف من التصنيف المنفصل إلى تقييم الشدة المستمر (0-100)، مما يظهر أداءً وتعميماً فائقين في مجالات مثل التمويل حيث تكون درجة المحتوى العاطفي حاسمة لاتخاذ القرار.

Francesco A. Fabozzi, Dasol Kim, William N. Goetzmann2026-05-19
💬 NLP

SKG-Eval: Stateful Evaluation of Multi-Turn Dialogue via Incremental Semantic Knowledge Graphs

يُعد SKG-Eval إطار عمل جديداً وقابلاً للتفسير، يقوم بتقييم أنظمة الحوار متعددة الأدوار عبر بناء رسم بياني معرفي دلالي بشكل تدريجي للكشف عن التناقضات وعدم الاتساق بعيد المدى من خلال تتبع الحالة المهيكل، محققاً بذلك ارتباطاً أعلى مع الأحكام البشرية مقارنة بالمقاييس المسطحة أو تلك التي تعتمد على الدور المنفرد.

Avijit Shil, Suman Samui2026-05-19✓ Author reviewed
💬 NLP

A Scalable Tool for Measuring Manner and Result Verbs in Developmental Language Research

تقدم هذه الورقة أداة حوسبة قابلة للتوسع تسخر النماذج اللغوية الكبيرة لتوليد بيانات تدريب لمصنف قائم على نموذج RoBERTa، محققة دقة تصل إلى 89.6% في التمييز بين أفعال الأسلوب وأفعال النتيجة لدعم أبحاث لغوية نمائية واسعة النطاق.

Divyesh Pratap Singh, Dakshesh Gusain, Federica Bulgarelli, Alison Eisel Hendricks, John Beavers, Nathan M. Beers, Ifeom (…)2026-05-19
🧬 biology

EmoMind: Decoding Affective Captions from Human Brain fMRI

يُعد EmoMind مساراً مبتكراً متكاملاً يقوم بفك تشفير التعليقات الوصفية العاطفية مباشرة من إشارات التصوير بالرنين المغناطيسي الوظيفي (fMRI) عبر الجمع بين الأوصاف المشهدية ذات المرجعية الدلالية ومتجهات عاطفية مستمرة مكونة من 34 بُعداً، مما يتفوق بشكل ملحوظ على النماذج المرجعية القائمة على التصنيفات المنفصلة في توليد سرديات عاطفية مخصصة وفردية.

Bilal A. Mohammed, Lin Gu, Ruogo Fang2026-05-19
💬 NLP

Exploring Lightweight Large Language Models for Court View Generation

تستقصي هذه الورقة بشكل منهجي قدرات النماذج اللغوية الكبيرة خفيفة الوزن (أقل من 2 مليار معلمة) في توليد حيثيات أحكام المحاكم الجنائية والتنبؤ بالتهم، مقدمةً إطار تقييم CVGEvalKit لتحليل المقايضات بين بنية النموذج، وحجمه، والترابط بين المهام، مع إثبات إمكانات هذه النماذج في مجال الذكاء الاصطناستيائي القضائي.

Zhitian Hou, Tianyong Hao, Nanli Zeng, Zhixiong Chao, Kun Zeng2026-05-19
🤖 machine learning

TIER: Trajectory-Invariant Execution Rewards for Multi-Step Tool Composition

تقترح الورقة البحثية TIER، وهو إطار عمل للمكافأة يستفيد من مخططات الدوال والتنفيذ أثناء التشغيل لتوفير إشراف كثيف وغير مرتبط بمسار محدد لاستخدام الأدوات متعدد الخطوات، مما يمكّن النماذج اللغوية الكبيرة من تحقيق دقة عالية في المهام التركيبية المعقدة حيث تفشل الأساليب الحالية القائمة على المسارات.

Anay Kulkarni, ChiaEn Lu, Dheeraj Mekala, Jayanth Srinivasa, Gaowen Liu, Jingbo Shang2026-05-19
🤖 machine learning

FIM-LoRA: Task-Informative Rank Allocation for LoRA via Calibration-Time Gradient-Variance Estimation

تُعد FIM-LoRA طريقة خفيفة الوزن وخالية من التدريب تعمل على تحسين أداء LoRA عبر إعادة توزيع ميزانية الرتبة (rank budget) عبر الطبقات بناءً على تقديرات تباين التدرج قبل الضبط الدقيق، مما يحقق نتائج مماثلة لـ LoRA القياسي ذي الرتبة الموحدة مع توفير رؤى قابلة للتفسير حول مدى إخبارية الطبقات لمهمة محددة.

Ramakrishnan Sathyavageeswaran2026-05-19
🤖 machine learning

Decoupling KL and Trajectories: A Unified Perspective for SFT, DAgger, Offline RL, and OPD in LLM Distillation

تقترح هذه الورقة إطاراً موحداً يفك الارتباط بين خيارات مصدر البادئة (prefix source) واتجاه تباعد كولباك - ليبلر (KL divergence) المرتبطة تقليدياً في عملية تقطير النماذج اللغوية الكبيرة، مما يكشف عن أربعة أهداف متميزة ويقدم تقنيات عملية مثل خلط تباعد كولباك - ليبلر (KL mixing) والمناهج القائمة على بوابات الإنتروبيا (entropy-gated curricula) لتحسين المقايضات بين الدقة والتنوع والكفاءة في مهام الاستدلال.

Anhao Zhao, Haoran Xin, Yingqi Fan, Junlong Tong, Wenjie Li, Xiaoyu Shen2026-05-19