💬 NLP

WCM: A World Critic Model for Vision-Language-Action Reinforcement Learning

تقدم الورقة البحثية نموذج "ناقد العالم" (WCM)، وهو نهج مبتكر للتعلم المعزز القائم على الرؤية واللغة والأفعال، يستفيد من بنية LeJEPA خفيفة الوزن للتنبؤ المشترك بالحالات الكامنة المستقبلية وتقدير القيم، مما يتغلب على قيود الناقد أحادي الإطار ويحقق أداءً رائدًا وقدرة على التعميم عبر مهام التلاعب الروبوتية المتنوعة.

Senyu Fei, Xiaopeng Yu, Siyin Wang, Xianzhong Zhao, Jingjing Gong, Xipeng Qiu2026-08-03
💬 NLP

LLM Self-Correction with DeCRIM: Decompose, Critique, and Refine for Enhanced Following of Instructions with Multiple Constraints

تقدم هذه الورقة RealInstruct، وهو معيار لتقييم النماذج اللغوية الكبيرة على التعليمات الواقعية متعددة القيود، وتقترح DeCRIM، وهو مسار تصحيح ذاتي يُمكّن النماذج مفتوحة المصدر من التفوق على GPT-4 من خلال تفكيك التعليمات، ونقد الاستجابات، وتحسين المخرجات.

Thomas Palmeira Ferraz, Kartik Mehta, Yu-Hsiang Lin, Haw-Shiuan Chang, Shereen Oraby, Sijia Liu, Vivek Subramanian, Tagy (…)2026-07-31
💬 NLP

Hallucinations and Truth: A Comprehensive Accuracy Evaluation of RAG, LoRA and DoRA

تقدم هذه الورقة تقييماً تجريبياً واسع النطاق لكل من RAG وLoRA وDoRA على 20,000 استعلام، مما يثبت أن DoRA يتفوق على كلتا الطريقتين في الدقة والارتباط وزمن الاستجابة لتطبيقات الذكاء الاصطنا_التوليدي المتخصصة في مجالات معينة.

Mohammad Baqar, Rajat Khanda2026-07-31
💬 NLP

Towards Structurally Explainable Machine-Generated Text Detection: A Graph-Perspective Framework

تقدم هذه الورقة البحثية \textsc{LM2^2otifs}، وهو إطار عمل قائم على الرسوم البيانية يحول النصوص إلى رسوم بيانية للتوافق اللفظي لتحقيق أداء فائق في كشف النصوص المولدة آلياً، مع توفير تفسيرات هيكلية عالية الرتبة وأكثر دقة تتجاوز قيود طرق الأهمية التقليدية القائمة على مستوى الرمز (token).

Xu Zheng, Zhuomin Chen, Esteban Schafir, Sipeng Chen, Hojat Allah Salehi, Haifeng Chen, Farhad Shirani, Mo Sha, Wei Chen (…)2026-07-31
💬 NLP

Route to Reason: Adaptive Routing for LLM and Reasoning Strategy Selection

تقترح الورقة البحثية إطار عمل "المسار إلى التفكير" (Route-To-Reason - RTR)، وهو إطار توجيه موحد يختار ديناميكيًا النماذج اللغوية واستراتيجيات الاستدلال المثلى بناءً على صعوبة المهمة لتحقيق دقة فائقة مع تقليل التكاليف الحسابية بشكل كبير وتجنب الإفراط في التفكير.

Zhihong Pan, Kai Zhang, Yuze Zhao, Yupeng Han2026-07-31
💬 NLP

CRMWeaver: Building Powerful Business Agent via Agentic RL and Shared Memories

يُعد CRMWeaver إطار عمل مبتكر لبناء وكلاء أعمال أقوياء يستفيد من توليد البيانات الاصطناعية والتعلم التعزيزي للتدريب، مقترناً بآلية ذاكرة مشتركة أثناء الاستدلال، للتعامل بفعالية مع مهام الأعمال المعقدة وغير المتجانسة وتحقيق أداء تنافسي في مجموعة بيانات CRMArena-Pro.

Yilong Lai, Yipin Yang, Ting Liang, Jialong Wu, Zhenglin Wang, Jianguo Lin, Keping Yang2026-07-31
💬 NLP

Select or Project? Evaluating Lower-dimensional Vectors for LLM Training Data Explanations

تُثبت هذه الورقة أن الاختيار الجشع لمجموعة فرعية صغيرة ومستنيرة معمارياً من مكونات النموذج هو أكثر فعالية وكفاءة من الناحية الحسابية من استخدام التدرجات الكاملة أو الإسقاطات العشوائية لتوليد تفسيرات قائمة على الحالات لنماذج اللغات الكبيرة.

Lukas Hinterleitner, Loris Schoenegger, Benjamin Roth2026-07-31
💬 NLP

Scaling medical imaging report generation with multimodal reinforcement learning

تقدم هذه الورقة البحثية "توليد التقارير الشامل" (UniRG)، وهو إطار عمل للتعلم التعزيزي متعدد الوسائط يتغلب على قيود الإفراط في التخصيص الناتجة عن الضبط الدقيق الخاضع للإشراف، وذلك لتحقيق أداء رائد وتعميم مستدام في توليد تقارير الصور الطبية، كما هو موضح من خلال سجله القياسي الجديد في تقارير الأشعة السينية للصدر.

Qianchu Liu, Sheng Zhang, Guanghui Qin, Yu Gu, Ying Jin, Sam Preston, Yanbo Xu, Sid Kiblawi, Wen-wai Yim, Timothy Ossows (…)2026-07-31
💬 NLP

The Confidence Manifold: Geometric Structure of Correctness Representations in Language Models

تكشف هذه الورقة أن التمثيلات الداخلية للصدق في النماذج اللغوية تشكل بنية هندسية بسيطة ومنخفضة الأبعاد محددة بمركز ثقل الفئات، مما يتيح كشفاً فعالاً للغاية وتلاعباً سببياً بالهلوسة من خلال المجسات الخطية وتوجيه التنشيط.

Seonglae Cho, Zekun Wu, Kleyton Da Costa, Adriano Koshiyama2026-07-31
💬 NLP

VISTA: A Controllable Platform for Generating and Auditing Egocentric Assistance Scenarios

تُعد VISTA منصة قابلة للتحكم تُنشئ سيناريوهات مساعدة من منظور الشخص الأول (egocentric) تكون قابلة للتدقيق والتحرير والتنوع، وذلك انطلاقاً من بذور لغوية طبيعية عبر مسار عمل مكون من ست مراحل، مما يتيح إنشاء بيانات مرئية واقعية لتقييم قدرات المساعدة الاستباقية لوكلاء الذكاء الاصطناعي مع التغلب على قيود الجمع في العالم الحقيقي والمحاكاة الحالية.

Yu-Hsiang Liu, Yu-Chien Tang, An-Zi Yen2026-07-31