💬 NLP

Calibrate-Then-Act: Cost-Aware Exploration in LLM Agents

تقدم هذه الورقة إطار عمل "المعايرة ثم التنفيذ" (CTA)، الذي يزود وكلاء النماذج اللغوية الكبيرة (LLMs) بمتطلبات سابقة مستنتجة حول حالات البيئة الكامنة للتفكير صراحةً في مقايضات التكلفة وعدم اليقين، مما يمكنهم من اكتشاف استراتيجيات اتخاذ قرار متسلسلة أكثر مثالية في مهام مثل الإجابة على الأسئلة المدعومة بالاسترجاع والبرمجة دون الاعتماد على التعلم المعزز القياسي.

Wenxuan Ding, Nicholas Tomlin, Greg Durrett2026-05-19
💬 NLP

Surgical Post-Training: Proximal On-Policy Distillation for Reasoning with Knowledge Retention

تقترح الورقة البحثية التدريب اللاحق الجراحي (SPOT)، وهو إطار عمل تقريب للتقطير القائم على السياسة، يستخدم مسار تصحيح البيانات وهدف مكافأة مقيد بتباعد كولباك - ليبلر لتعزيز قدرات الاستدلال في النماذج اللغوية الكبيرة بكفاءة مع الحد من النسيان الكارثي بشكل فعال.

Wenye Lin, Kai Han2026-05-19
💬 NLP

SkillMAS: Skill Co-Evolution with LLM-based Multi-Agent System

يُعد SkillMAS إطار عمل غير معلمي يربط في آن واحد بين تطور المهارة وإعادة هيكلة الأنظمة متعددة الوكلاء من خلال تعلم المنفعة، وصقل المهارة المقيد، وإعادة التنظيم المبوّب بالأدلة، وذلك للتغلب على اختناقات التكيف وتمكين التخصص الفعال لما بعد النشر عبر مهام متنوعة.

Shuai Pan, Yixiang Liu, Jiaye Gao, Te Gao, Weiwen Liu, Jianghao Lin, Zhihui Fu, Jun Wang, Weinan Zhang, Yong Yu2026-05-19
💬 NLP

LLM-Based Intelligent Notification Composition: From Static Personalization to Context-Aware Persuasive Messaging

تجادل هذه الورقة بأن النماذج اللغوية الكبيرة (LLMs) توفر فرصة متميزة وغير مستثمرة بما يكفي لتحسين فعالية إشعارات الدفع من خلال تحويل التركيز من التخصيص الساكن إلى الرسائل الإقناعية الواعية بالسياق، مما يوفر إطاراً لتحديد جودة الرسالة، وفصل مكاسب التوليد عن مكونات النظام الأخرى، وتوجيه النشر الاستراتيجي عبر مجالات متنوعة.

Nilesh Agrawal2026-05-19
💬 NLP

When AI Tells You What You Want to Hear: Sycophantic Behavior of Large Language Models in Dementia Care Settings

تُظهر هذه الدراسة أن النماذج اللغوية الكبيرة تُبدي سلوكاً تملقياً ملحوظاً في سياقات رعاية مرضى الخرف، حيث تتدهور جودة الاستجابات أخلاقياً ومهنياً بشكل منهجي عند التعامل مع المحفزات التي تشير إلى وجود سلطة، مما يشكل مخاطر حرجة للنشر في مجالات الرعاية الصحية عالية المخاطر.

Christian Kolb2026-05-19
💬 NLP

Linguistic Uncertainty and Reply Engagement on X: A Cross-Domain Replication of the Uncertainty-Reply Asymmetry

تُعيد هذه الدراسة محاكاة "عدم التماثل بين عدم اليقين والرد" في سياق اللغة الإنجليزية من خلال إثبات أن المنشورات التي تحتوي على عدم يقين لغوي فيما يتعلق بسياسة الاحتياطي الفيدرالي، والتضخم، والسياسة الانتخابية تولد ردوداً أكثر بكثير من المنشورات اليقينية، مما يشير إلى وجود آلية عامة عابرة للمجالات حيث يدفع عدم اليقين نحو التفاعل الحواري.

Mohamed Soufan2026-05-19
💬 NLP

ANVIL: Analogies and Videos for Lecturers

تقدم هذه الورقة نظام ANVIL، وهو نظام توليدي متعدد الوسائط يعمل على أتمتة إنشاء الرسوم المتحركة التعليمية القائمة على القياس لـمواضيع علوم الحاسوب، موضحاً من خلال تقييمات المعلمين والدراسات المستخدمة أنه ينتج مواد تعليمية كافية مع استقبال إيجابي من قبل التربويين.

Yuri Noviello, Anastasiia Birillo, Gosia Migut2026-05-19
💬 NLP

Vidya: An AI-Driven Modular Pipeline for Archival Automation and Semantic Metadata Enrichment

تُعد "فيديا" (Vidya) خط إنتاج برمجياً نموذجياً ومفتوح المصدر تم تطويره في جامعة "يبيجي" (UEPG)، حيث يستفيد من النماذج اللغوية الكبيرة المقيدة بأنطولوجيات "YAML" والتحقق من صحة البيانات عبر "Pydantic" لأتمتة الإثراء الدلالي والإدراج الأرشيفي لـ "البيانات المظلمة" التاريخية، مما يقلل زمن المعالجة بشكل كبير من عقود إلى أيام مع ضمان الامتثال للمعايير الدولية مثل "NOBRADE" و"ISAD(G)".

Cloter Migliorini Filho, Julia Graciela Machado, Edson Armando Silva, Marcella Scoczynski2026-05-19
🤖 machine learning

DACA-GRPO: Denoising-Aware Credit Assignment for Reinforcement Learning in Diffusion Language Models

يعالج DACA-GRRO أوجه القصور في أساليب التعلم التعزيزي الحالية لنماذج الانتشار اللغوية من خلال تقديم درجات تقدم إزالة الضجيج واحتمالية القناع الطبقي لتمكين التخصيص الائتماني الزمني وتقليل انحياز المجال المتوسط، مما يؤدي إلى تحسينات كبيرة في الأداء عبر مختلف معايير الاستدلال والتوليد.

Amin Karimi Monsefi, Dominic Culver, Nikhil Bhendawade, Lokesh Boominathan, Manuel R. Ciosici, Yizhe Zhang, Irina Belous (…)2026-05-19
💬 NLP

Hilbert-Geo: Solving Solid Geometric Problems by Neural-Symbolic Reasoning

تقدم الورقة البحثية Hilbert-Geo، وهو إطار عمل عصبي-رمزي يوحد المدخلات اللغوية الطبيعية والبصرية في لغة صورية لتحقيق أداء رائد في حل مسائل الهندسة المستوية والصلبة المعقدة من خلال استدلال قابل للتحقق وقابل للقراءة من قبل البشر.

Ruoran Xu, Haoyu Cheng, Bin Dong, Qiufeng Wang2026-05-19