🤖 machine learning

GROM: Gradient-Free Rapid One-Shot Machine Unlearning

يُعد GROM طريقة مبتكرة لتعلم الآلة غير المعتمد على التراجع (unlearning)، وهي طريقة من خطوة واحدة وخالية من التدرج، تستنتج تحديثًا تحليليًا مغلق الصيغة لتطهير المعرفة الحساسة بسرعة وبشكل دائم من النماذج اللغوية الكبيرة مع الحفاظ على الفائدة ومقاومة هجمات الاسترداد القائمة على التكميم.

Paweł Batorski, Przemysław Spurek, Paul Swoboda2026-08-07
💬 NLP

Task-Conditional Flow Matching for Balanced Multilingual Text Embedding Adaptation

تقدم الورقة البحثية "مطابقة التدفق المشروطة بالمهمة" (TCFM)، وهو إطار عمل مبتكر لتكييف التضمين متعدد اللغات يطبق "مطابقة التدفق" بشكل انتقائي على مهام الترجمة مع استخدام أهداف محسنة للمهام الأخرى، محققاً أداءً هو الأفضل في فئته على مقيش "إنديك" (Indic) لتقييم تضمين النصوص الضخمة من خلال منهج تعليمي موجه بالمعلم يتكون من ثلاث مراحل.

Tirth Bhatt, Naren Kumar S, Mayank Singh2026-08-07
🤖 machine learning

Predicting Task Difficulty Without Rollouts

تقترح هذه الورقة طريقة للتنبؤ بصعوبة المهمة مباشرة من أوصاف المهام دون تنفيذ عمليات محاكاة (rollouts) مكلفة عبر 17 معياراً متنوعاً للوكلاء، مما يثبت أن الإنتروبيا على مستوى الرمز (token-level entropy) تعمل كإشارة تنبؤية موثوقة بينما تكشف عن قصور المقاييس التقليدية مثل المساحة تحت المنحنى (AUC) وتظهر عيوباً خفية في البيئة.

Stefan Krsteski, Charlotte Meyer2026-08-07
💬 NLP

On-Policy Delta Distillation for Multilingual Math Reasoning

تُظهر هذه الورقة أن تقنية التقطير التفاضلي في السياسة نفسها (OPD2^2)، التي تستفيد من فجوة الاحتمالية بين المعلم بعد التدريب والنموذج الأساسي، تعزز بشكل كبير الاستدلال الرياضي متعدد اللغات في الكورية واليابانية مع تضييق فجوات الأداء، رغم أنها تؤكد على ضرورة وجود بيانات متعددة اللغات لمنع التحولات في الاستجابة نحو المركزية الإنجليزية.

Byeongho Heo, Jaehui Hwang, Sangdoo Yun, Dongyoon Han2026-08-07
💬 NLP

Hierarchical Latent Prediction for Language Models

تقدم هذه الورقة التنبؤ الكامن الهرمي (HiLP)، وهو هدف مساعد مبتكر يستفيد من الكوامن المجردة عالية المستوى للتخفيف من تراكم الأخطاء في عمليات التدحرج في الفضاء الكامن، مما يؤدي إلى تحسين الاستدلال طويل الأمد، وأداء البرمجة، وكفاءة فك التشفير الاستباقي في النماذج اللغوية.

Chang Shi, Tim Pearce, Manan Tomar, Siddhartha Sen, John Langford2026-08-07
💬 NLP

Decomposed Entailment for Factuality Checking and Hallucination Detection

تقدم هذه الورقة HallDetect، وهو إطار عمل خفيف الوزن، وخالٍ من المراجع، وصندوق أسود، يكتشف الهلوسة في توليد النماذج اللغوية الكبيرة المستندة إلى المصدر عبر تفكيك المحتوى إلى ادعاءات ذرية، والتحقق منها عبر الاستلزام التبايني مقابل أجزاء المصدر، وتجميع النتائج بآلية تسجيل غير متماثلة للتفوق على النماذج المرجعية المقارنة مع توفير مسارات تدقيق للأخطاء موضعية.

Achir Oukelmoun, Nasredine Semmar, Gaël De Chalendar2026-08-07
💬 NLP

Enhancing Social Intelligence in LLMs with Hierarchical Reasoning and Utterance-Level Goal Rewarding

تقترح هذه الورقة إطار عمل "التفكير-الاستراتيجية-الاستجابة" (TSR)، الذي يفكك الحوار الاجتماعي إلى مراحل تخطيط وتنفيذ هرمية ويقوم بتحسينه باستخدام خوارزمية تعلم تعزيزي هرمي خطي مبتكرة مع مكافآت محكومة بالتباين (LHRL-VGR)، محققةً أداءً هو الأفضل في حالته في مهام التفاوض بين الوكلاء من خلال تجاوز نموذج GPT-4o في اختبار SOTOPIA المرجعي.

Xiaofeng Wang, Kakam Chong, Shuai Xiao, DeXin Kong, Qingyuan Tian, Chen Ju, Xu Yan, Shuai Zhao, Fei Huang, Rui Wang, Shu (…)2026-08-07
💬 NLP

MACRO: Markov Chain Routing of Transformer Layers

تقدم الورقة البحثية إطار العمل MACRO، الذي يعزز النماذج اللغوية الكبيرة من خلال تعلم سياسات توجيه طبقات ديناميكية ومخصصة للمهام عبر سلاسل ماركوف دون تعديل أوزان النموذج، محققاً تحسينات كبيرة في الدقة وأوقات بحث أسرع مقارنة بالطرق الحالية.

Paweł Batorski, Abtin Pourhadi, Akylgali Aitaza, Przemysław Spurek, Paul Swoboda2026-08-07
💬 NLP

Causal Episodic Memory for Feedback-Driven Agent Repair

تقدم الورقة البحثية MERIT، وهو وكيل لا يتطلب تدريباً يستفيد من ذاكرة عرضية سببية ثنائية القطب للتصحيحات المتحقق منها والمحاولات الفاشلة لتوجيه الاسترجاع الهجين لإصلاح تحويل النص إلى SQL، محققاً تحسينات متواضعة في دقة التنفيذ مقارنة بالطرق عديمة الحالة على معايير Spider وBIRD دون الحاجة إلى تحديث معاملات النموذج.

Khang Nhat Hoang Vo, Tam Minh Chu, Anh Trac Duc Dinh, Thuyen Vinh Ha Bui, Tho Quan2026-08-07
💬 NLP

Clinical Communication Processing with Models Trained on LLM-Generated Synthetic Data: A Structured Survey and Novel Application Case Studies

تقدم هذه الورقة مسحاً هيكلياً وثلاث عشرة دراسة حالة مبتكرة تُثبت أن النماذج اللغوية الكبيرة يمكنها توليد بيانات تواصل سريري اصطناعية لتعزيز أنظمة معالجة اللغات الطبيعية بفعالية لمختلف سيناريوهات الرعاية الصحية، على الرغم من القيود الحالية في التحقق من الأداء باستخدام بيانات حقيقية من الواقع.

Alexander Apartsin, Yehudit Aperstein2026-08-07