💬 NLP

Dynamic Decision Learning: Test-Time Evolution for Abnormality Grounding in Rare Diseases

تقدم هذه الورقة "تعلم القرار الديناميكي" (DDL)، وهو إطار عمل يعزز نماذج الرؤية واللغة الضخمة المجمدة لتحديد مواضع الشذوذ في الأمراض النادرة بمتانة عبر صقل القرارات بشكل تكراري عبر الفضاءات اللغوية والبصرية، مما يحسن دقة التحديد ومعايرة الثقة بشكل كبير دون الحاجة إلى ضبط دقيق تحت الإشراف.

Jun Li, Mingxuan Liu, Jiazhen Pan, Che Liu, Wenjia Bai, Cosmin I. Bercea, Julia A. Schnabel2026-04-29
💬 NLP

Dont Stop Early: Scalable Enterprise Deep Research with Controlled Information Flow and Evidence-Aware Termination

تقترح هذه الورقة بنية تحتية قابلة للتوسع للبحث العميق في المؤسسات (EDR) تستخدم توليد المخططات التفصيلية مع التفكير، وتحديد سياق المواقع بناءً على التبعية، ومعايير إنهاء قائمة على الأدلة للتغلب على مشكلات التغطية غير المتساوية والتوقف المبكر، مما يظهر أداءً فائقاً في كل من مهام تمكين المبيعات الداخلية والمؤشرات المرجعية العامة.

Prafulla Kumar Choubey, Kung-Hsiang Huang, Pranav Narayanan Venkit, Jiaxin Zhang, Vaibhav Vats, Yu Li, Xiangyu Peng, Chi (…)2026-04-29
💬 NLP

Leverage Laws: A Per-Task Framework for Human-Agent Collaboration

تقترح هذه الورقة إطار عمل معياري لـ "نسبة الرافعة المالية" للتعاون بين الإنسان والوكيل، والذي يقيس الكفاءة من خلال مقارنة العمل البشري المُزاح مقابل تكاليف الوقت الخاصة بالتوصيف، وحل الانقطاعات، والمراجعة، مع تحليل كيفية قيام قيود تدفق المعلومات وجدة المهام بتقييد توسع الرافعة المالية لكل مهمة وعلى مستوى النافذة الزمنية.

Stan Loosmore2026-04-29
💬 NLP

Analyzing LLM Reasoning to Uncover Mental Health Stigma

تقترح هذه الورقة إطار عمل جديداً يحلل خطوات الاستدلال الوسيطة للنماذج اللغوية الكبيرة، بدلاً من مجرد مخرجاتها النهائية، للكشف عن وصمة العار الخفية المتعلقة بالصحة النفسية وتصنيفها، والتي تفشل التقييمات التقليدية القائمة على الاختيار من متعدد في اكتشافها.

Sreehari Sankar, Aliakbar Nafar, Mona Barman, Hannah K. Heitz, Ashwin Kumar, Pouria Tohidi, Dailun Li, Danish Hussain, R (…)2026-04-29
💬 NLP

Cooperate to Compete: Strategic Coordination in Multi-Agent Conquest

تقدم هذه الورقة "التعاون من أجل التنافس" (C2C)، وهي بيئة متعددة الوكلاء مصممة لدراسة التنسيق الاستراتيجي في الأوضاع ذات الدوافع المختلطة، مما يكشف عن فروق سلوكية جوهرية بين البشر ووكلاء النماذج اللغوية في المفاوضات الخاصة، ويوضح كيف يمكن للتوجيه المستهدف أن يحسن بشكل كبير من معدلات فوز الذكاء الاصطناعي.

Abigail O'Neill, Alan Zhu, Mihran Miroyan, Narges Norouzi, Joseph E. Gonzalez2026-04-29
💬 NLP

The Dynamics of Delusion: Modeling Bidirectional False Belief Amplification in Human-Chatbot Dialogue

تقدم هذه الورقة أول دليل كمي على أن التفاعلات بين البشر وروبوتات الدردشة تخلق حلقات تغذية راجعة ثنائية الاتجاه من الوهم، حيث يدفع البشر زيادات حادة وفورية في المعتقدات الزائفة بينما تعمل روبوتات الدردشة على استدامة هذه الآثار ونشرها عبر أطر زمنية أطول من خلال آليات تعزيز ذاتي.

Ashish Mehta, Jared Moore, Jacy Reese Anthis, William Agnew, Eric Lin, Peggy Yin, Desmond C. Ong, Nick Haber, Carol Dwec (…)2026-04-29
💬 NLP

LongSumEval: Question-Answering Based Evaluation and Feedback-Driven Refinement for Long Document Summarization

تقدم الورقة البحثية LongSumEval، وهو إطار عمل موحد يربط بين التقييم والتوليد لتلخيص المستندات الطويلة باستخدام تغذية راجعة قائمة على الإجابة عن الأسئمة المهيكلة لتوفير درجات قابلة للتفسير وإرشادات قابلة للتنفيذ، مما يحسن بشكل كبير جودة الملخصات ومواءمتها مع الأحكام البشرية دون الحاجة إلى إعادة تدريب النموذج.

Huyen Nguyen, Haoxuan Zhang, Yang Zhang, Haihua Chen, Junhua Ding2026-04-29
💬 NLP

FAMA: Failure-Aware Meta-Agentic Framework for Open-Source LLMs in Interactive Tool Use Environments

تقدم الورقة البحثية FAMA، وهو إطار عمل ثنائي المراحل يعزز موثوقية وكلاء النماذج اللغوية الكبيرة (LLM) مفتوحة المصدر في بيئات استخدام الأدوات التفاعلية من خلال تحليل مسارات الفشل وتنسيق وكلاء متخصصين لحقن سياق مستهدف، مما يؤدي إلى مكاسب في الأداء تصل إلى 27% مقارنة بالنماذج المرجعية القياسية.

Amir Saeidi, Venkatesh Mishra, Souradeep Mukhopadhyay, Gaowen Liu, Ali Payani, Jayanth Srinivasa, Chitta Baral2026-04-29
💬 NLP

Frictive Policy Optimization for LLMs: Epistemic Intervention, Risk-Sensitive Control, and Reflective Alignment

تقدم هذه الورقة "تحسين السياسة الاحتكاكية" (FPO)، وهو إطار عمل مبتكر يعيد صياغة محاذاة النماذج اللغوية الكبيرة كمسألة تحكم معرفي حساسة للمخاطر، حيث تتعلم الوكلاء كيفية النشر الاستراتيجي للتدخلات مثل الاستيضاح والرفض لإدارة عدم اليقين والمخاطر المعيارية، بدلاً من مجرد التحسين من أجل مكافآت المهام الفورية.

James Pustejovsky, Nikhil Krishnaswamy2026-04-29
💬 NLP

MGTEVAL: An Interactive Platform for Systemtic Evaluation of Machine-Generated Text Detectors

تقدم هذه الورقة MGTEVAL، وهي منصة تفاعلية وقابلة للتوسع تعمل على توحيد تقييم كواشف النصوص المولدة آلياً من خلال دمج بناء مجموعات البيانات، ومحاكاة الهجمات، وتدريب الكواشف، ومقاييس الأداء في سير عمل قابل لإعادة الإنتاج يمكن الوصول إليه عبر كل من واجهات سطر الأوامر والواجهات الويب.

Yuanfan Li, Qi Zhou, Chengzhengxu Li, Zhaohan Zhang, Chenxu Zhao, Zepu Ruan, Chao Shen, Xiaoming Liu2026-04-29