💬 NLP

Learning When to Trust via Selective Context Preference Optimization

تقدم الورقة البحثية MIST، وهو معيار للثقة الانتقائية، وتقترح SCOPE، وهي طريقة تدريب تعمل على تحسين النماذج لمقاومة السياق المضلل مع الحفاظ على قدرتها على الاستخدام الصحيح للمعلومات المفيدة أو غير ذات الصلة، مما يعالج قصور مجرد تجاهل جميع الإشارات الخارجية.

Xian Sun, Wei Chow, Yingshuo Wang, Junhao Liu, Wei Gao, Qing Wu, Lingdong Kong2026-08-07
🔬 physics

Leveraging Machine Learning to Gain Insights on Quantum Thermodynamic Entropy

تقدم هذه الورقة تحليلاً ثيرموديناميكياً مدعوماً بالتعلم الآلي لمحرك "سيلارد" الكمي باستخدام جسيم واحد، مع مقارنة تكاليف معالجة المعلومات وآليات التشغيل بنظيرتها الكلاسيكية لتوضيح المقايضات الثيرموديناميكية ودور إدراج الحواجز في النظام الكمي.

Srinivasa Rao. P2026-08-06
🤖 machine learning

Unforgettable Generalization in Language Models

تتقصى هذه الورقة كيفية سلوك النماذج اللغوية عند "نسيان" المهارات عبر الضبط الدقيق باستخدام تسميات عشوائية، كاشفةً أن تعميم النسيان غير متوقع للغاية ويعتمد على المهمة، حيث يفشل غالباً في الامتداد إلى ما وراء أمثلة تدريبية محددة رغم المخرجات العشوائية ظاهرياً، بينما تظل قدرات المهام الكامنة سليمة كما يتضح من نجاح الاختبار الخطي.

Eric Zhang, Leshem Choshen, Jacob Andreas2026-08-06
💬 NLP

MathDebugger: Detecting and Diagnosing Errors in Synthetic Mathematical Data

تقدم هذه الورقة MathDebugger، وهو معيار شامل يتكون من 6,000 حالة رياضية تم التحقق منها يدويًا مع تعليقات توضيحية دقيقة للأخطاء، لتقييم وكشف حدود النماذج اللغوية الكبيرة الحالية في اكتشاف وتشخيص الأخطاء في البيانات الرياضية الاصطناعية مع إثبات قيمة معلومات نوع الخطأ الصريحة لتحسين جودة البيانات.

Hao Liang, Meiyi Qiang, Yuying Li, Zefeng He, Xiaochen Ma, Ruichuan An, Yongzhen Guo, Zhengzhou Zhu, Bin Cui, Wentao Zha (…)2026-08-06
🤖 AI

Review Text as a Leading Indicator of Displayed Reputation in Platform Rating Systems: Evidence from 34 U.S. Short-Term Rental Markets

تُثبت هذه الورقة أن المشاعر المُعبَّر عنها في نصوص المراجعات السابقة تعمل كمؤشر استباقي دقيق للتحسينات المستقبلية في التقييمات المعروضة في أسواق التأجير قصير الأمد في الولايات المتحدة، مما يكشف أن أنظمة التقييم الحالية للمنصات تتجاهل معلومات قيمة محتفظ بها داخل نص المراجعة نفسه.

Ali Safari2026-08-06
💬 NLP

v1: Learning to Point Visual Tokens for Multimodal Grounded Reasoning

تقدم الورقة البحثية v1، وهي امتداد خفيف الوزن للنماذج اللغوية متعددة الوسائط يتيح الإسناد البصري النشط من خلال آلية دلالية للإشارة والنسخ، مما يسمح للنموذج باسترجاع وإعادة ربط رقع الصور ذات الصلة ديناميكيًا أثناء عملية الاستنتاج للتغلب على قيود الترميز البصري الثابت.

Jiwan Chung, Junhyeok Kim, Siyeol Kim, Jaeyoung Lee, Min Soo Kim, Youngjae Yu2026-08-06
💬 NLP

Esoteric Language Models: A Family of Any-Order Diffusion LLMs

تقدم الورقة البحثية نماذج Eso-LMs، وهي عائلة جديدة من النماذج اللغوية التي تدمج بين نماذج الانتشار المقنعة والنماذج ذات الترتيب الذاتي باستخدام الانتباه السببي لتمكين الحساب الدقيق للاحتمالية وتخزين الذاكرة المخبأة (KV caching)، مما يحقق أداءً رائدًا في الكفاءة والجودة على جبهة باريتو (Pareto frontier) بين السرعة والجودة في التوليد غير المشروط.

Subham Sekhar Sahoo, Zhihan Yang, Yash Akhauri, Johnna Liu, Deepansha Singh, Zhoujun Cheng, Zhengzhong Liu, Eric Xing, J (…)2026-08-06
🤖 AI

Pun Intended: Multi-Agent Translation of Wordplay with Contrastive Learning and Phonetic-Semantic Embeddings for CLEF JOKER 2025 Task 2

تقدم هذه الورقة إطار عمل جديداً متعدد الوكلاء يتكون من ثلاث مراحل يجمع بين النماذج اللغوية الكبيرة، والتضمينات الصوتية-الدلالية، والتعلم التبايني لترجمة التورية اللغوية من الإنجليزية إلى الفرنسية بنجاح، محققةً مراكز متقدمة في مسابقة CLEF JOKER 2025 عبر إعطاء الأولوية للإبداع اللغوي على الترجمة الحرفية.

Russell Taylor, Benjamin Herbert, Michael Sana2026-08-06
💬 NLP

Enhancing Trustworthy Clinical Diagnosis Decision-Making in Large Language Models via Etiology-Aware Attention Supervision

تقترح هذه الورقة إطار عمل لـ "الإشراف على الانتباه الواعي للمسببات المرضية" يستفيد من مخططات المسببات السريرية المهيكلة لتوجيه آليات الانتباه في النماذج اللغوية الكبيرة، مما يعزز بشكل كبير دقة التشخيص وموثوقيته لحالات البطن الحادة دون تغيير بنية النموذج الأساسي.

Peixian Li, Yu Tian, Ruiqi Tu, Chengkai Wu, Jingjing Ren, Jingsong Li2026-08-06
🤖 AI

Memorization in Large Language Models in Medicine: Prevalence, Characteristics, and Implications

تتقصى هذه الدراسة بشكل منهجي مدى انتشار وخصائص وآثار الحفظ في النماذج اللغوية الكبيرة الطبية، كاشفةً عن أنه أكثر شيوعاً بشكل ملحوظ مما هو عليه في المجالات العامة، وأنه يستمر عبر سيناريوهات التكيف المختلفة مثل التدريب المسبق المستمر والضبط الدقيق على بيانات سريرية من العالم الحقيقي، ويشكل مخاطر حرجة فيما يتعلق بالخصوصية والقدرة على التعميم.

Anran Li, Lingfei Qian, Mengmeng Du, Yu Yin, Yan Hu, Zihao Sun, Yihang Fu, Hyunjae Kim, Erica Stutz, Xuguang Ai, Qianqia (…)2026-08-06