🤖 machine learning

The Replay Gap: Static Evaluation of Model Switching in LLM Agents Scores the Wrong World

تُثبت هذه الورقة أن طرق التقييم القائمة على إعادة التشغيل الساكنة تفشل جوهرياً في تقييم موجّهات وكلاء النماذج اللغوية الكبيرة، لأن استبدال مخرجات النموذج في المسارات المسجلة يتجاهل التباعد المتتالي لأفعال الوكيل اللاحقة، مما يؤدي إلى مقاييس أداء مضللة لا تعكس النتائج في العالم الحقيقي.

Ashritha Gonuguntla2026-08-11
🤖 machine learning

Learning from Environmental Feedback: Credit Assignment across Multiple Timescales for Agentic Reinforcement Learning

تقترح هذه الورقة البحثية منهجية "تخصيص الائتمان القائم على التغذية الراجعة البيئية" (EFCA)، وهي نهج للتعلم التعزيزي متعدد المقاييس الزمنية يستفيد من آثار الأفعال قصيرة المدى وأنماط تاريخ الحالة متوسطة المدى المستخرجة من التفاعلات البيئية لتفكيك المكافآت الشحيحة وتحسين الأداء في المهام الوكيلية طويلة الأمد.

Yifu Huo, Shunjie Xing, Chenglong Wang, Peinan Feng, Qiaozhi He, Yan Ding, Anxiang Ma, Yuxin Gao, Tongran Liu, Tong Xiao (…)2026-08-11
💬 NLP

Do Evaluation Metrics Detect Errors in Classical Chinese to English Translations?

تتقصى هذه الورقة مدى موثوقية مقاييس التقييم الآلي الحالية للترجمة من الصينية الكلاسيكية إلى الإنجليزية، كاشفةً أنه في حين أن جميع المقاييس تعاني من نقاط قصور، فإن MetricX24 هو الأفضل أداءً، مما يسلط الضوء على الحاجة الملحة لمقاييس أكثر قوة وقابلية للتفسير مصممة خصيصاً لأطر الترجمة المتميزة تاريخياً وثقافياً.

Osvaldo Quinjica, Eric Bennett, Xinchen Yang, Andrew Schonebaum, Marine Carpuat2026-08-11
🤖 AI

Mitigating Over-Personalization in LLMs via Structured Memory

تقترح هذه الورقة استخدام تنسيقات ذاكرة مهيكلة ومقسمة حسب النطاق بدلاً من القوائم غير المهيكلة للتخفيف بفعالية من تسرب النطاقات المتقاطعة والتملق الناجم عن الذاكرة في النماذج اللغوية الكبيرة المخصصة مع الحفاظ على فائدتها.

Hakeem Hannoon, Andrew Zhao, Mihir Narayan, Sharvin Goyal, Ivaxi Sheth2026-08-11
💬 NLP

Safety Cost of Steering Vectors Is Separable and Reducible

تقترح هذه الورقة طريقة تحسين لاحقة (post-hoc) تحدد وتزيل مكوناً قابلاً للفصل ومسبباً لتدهور السلامة من نواقل توجيه النماذج اللغوية الكبيرة، مما يخفف من مخاطر السلامة مع الحفاظ على التوجيه السلوكي المنشود وتقليل حالات الرفض الخاطئ.

Yuxiao Li, Gjergji Kasneci2026-08-11
💬 NLP

Hidden Language Consistency Phenomena in Reasoning LLMs

تكشف هذه الورقة أن نماذج الاستدلال متعددة اللغات غالباً ما تظهر "تأثير انهيار اتساق اللغة"، حيث يؤدي تزايد صعوبة المهمة إلى تحول مفاجئ نحو لغة داخلية مهيمنة، مما يؤدي إلى سيناريوهات يتم فيها الحفاظ على الدقة أو تحسينها رغم فقدان اتساق لغة المخرجات، مما يثبت أن التقييم الموثوق يتطلب مراعاة دقة المهمة واتساق اللغة والصعوبة بشكل مشترك.

Muhammad Ali Shafique, Kelly Marchisio2026-08-11
🤖 AI

LLM within MCP Matters: Measuring Inefficient Resource Utilization Driven by LLMs

تكشف هذه الدراسة أن النماذج اللغوية الكبيرة غالباً ما تتجاهل البيانات المرجعية المضمنة بكفاءة في تعليمات خادم بروتوكول سياق النموذج (MCP) لصالح أدوات البحث بسبب تفضيلات سلوكية، مما يستلزم وجود آليات صريحة على مستوى المضيف لإعطاء الأولوية لسياق التعليمات على اختيار الأدوات.

Minhan Cho, Soyoung Park, Kihyeon Jeong, Byeongkyu Jeon, Daejin Choi, Jinyoung Han2026-08-11
💬 NLP

VectraYX-Vision-1B: A Sub-2B Spanish/LATAM Cybersecurity Vision-Language Model with Structured Visual Reasoning and Native Tool Use

تقدم الورقة البحثية نموذج VectraYX-Vision-1B، وهو نموذج لغوي بصري باللغة الإسبانية يقل حجمه عن 2 مليار معلمة ومتخصص في أدوات الأمن السيبراني، يتميز بالاستدلال الهيكلي الأصيل واستخدام الأدوات، ولكنه يعاني حاليًا من ضعف في التأسيس البصري بسبب قيود التدريب وخطأ في نقطة التحقق، مما استدعى إصدار دراسة استئصالية وموارد مفتوحة المصدر لمعالجة هذه المشكلات.

Juan S. Santillana2026-08-11
🤖 AI

HoloAegis: Frozen Representation, Topological Inference: Minimally Parametric Safety Manifolds for Zero-Shot LLM Guardrails

يُعد HoloAegis إطار عمل أمانًًا ذو معلمات دنيا ولا يتطلب تدريبًا، حيث يحقق حواجز حماية متطورة لنماذج اللغات الكبيرة (LLMs) بنمط الصفر المعرفة عبر فصل التمثيلات الدلالية المجمدة عن الاستدلال الطوبولوجي الهندسي البحت، مما يلغي الحاجة إلى الضبط الدقيق مع ضمان زمن انتقال يقل عن الميلي ثانية ونقل قوي عبر اللغات.

Tak Ho Alex Li, Kaijie Liu, Lik-Hang Lee, Kin Chung Ho, Ping Shum, Michael K. Ng2026-08-11
💬 NLP

OpenVisTool: An Open Recipe for Synthesizing Instructive Visual Tool-Use Trajectories

تقدم الورقة البحثية OpenVisTool، وهو إطار عمل يعمل على تخليق مسارات استخدام أدوات إرشادية من خلال التصفية بناءً على كل من صحة الإجابة والمساهمة السببية لملاحظات الأدوات، مما ينتج عنه مجموعة بيانات ومعيار مرجعي يحسنان بشكل كبير أداء الوكلاء متعددي الوسائط عبر تعليم النماذج ربط استخدام الأدوات بالأدلة بدلاً من مجرد محاكاة أنماط الاستدعاء.

Changhao Xiang, Shilin Zhang, Zheng Ma, Kanzhi Cheng, Ruize Ma, Yi Feng, Jianbing Zhang, Zhi Wang, Zhen Wu, Xinyu Dai, L (…)2026-08-11