🤖 AI

KVDiagnosis: A Diagnostic Benchmark for KV-Cache Compression in Long-Context Language Models

تقدم هذه الورقة البحثية KVDiagnosis، وهو معيار تشخيصي ومجموعة بيانات شاملة تقيم طرق ضغط ذاكرة التخزين المؤقت لـ KV بشكل منهجي من خلال تصنيفها ضمن هيكلية تصنيفية، وعزل حالات الفشل المحددة عبر مقارنات محكومة، وتوفير قياسات تفصيلية لتحديد سبب فشل النماذج المضغوطة مع الحفاظ على تغطية عالية وتمكين التدخلات المستهدفة.

Chen Qiu, Ziwu Liu, Chao Fei, Guozhong Li, Panos Kalnis2026-08-11
💬 NLP

ZetaGPT: A Reference Implementation of Positional--Encoding--Free State--Space--Attention Language Models

تقدم هذه الورقة البحثية ZetaGPT، وهو نموذج لغوي صغير مفتوح المصدر يلغي التشفيرات الموضعية الصريحة من خلال دمج معادلات فضاء الحالة السببية لتشفير المعلومات التسلسلية ضمنياً قبل عملية الانتباه الذاتي، مع توفير مسار تدريب كامل من البداية إلى النهاية لأغراض البحث والتعليم.

Róisín Luo2026-08-11
🤖 machine learning

How Simple Can It Get? From Interpretable Equations to Readable Rules for Financial Decision Making

تقترح هذه الورقة إطار عمل لتبسيط النماذج المالية القابلة للتفسير تدريجياً من معادلات معقدة إلى قواعد وبطاقات نقاط سهلة القراءة، مما يثبت أن عمليات التبسيط هذه يمكن أن تحسن بشكل كبير من قابلية القراءة البشرية مع حد أدنى من الفقد في الأداء التنبؤي، مع توفير حدود نظرية لتوقع تدهور الدقة.

Adia Lumadjeng, Ilker Birbil, Erman Acar2026-08-11
🤖 AI

Listen, See and Track: Spatio-Temporal Audio-Visual Sound Event Reasoning for Omni-Modal Language Models

تقدم هذه الورقة ST-OmniQA، وهو معيار مرجعي واسع النطاق صوتي-بصري زماني-مكاني يضم 40 ألف فيديو بانورامي وصوت أمبيسونيكس (Ambisonics)، وتقترح ST-Omni-R1، وهو نموذج يتفوق بشكل كبير على النماذج المرجعية من خلال دمج الإشارات الصوتية الاتجاهية مع السياق البصري عبر التعلم المنهجي التدريجي والتعلم المعزز للاستنتاج حول هوية مصادر الصوت وموقعها وحركتها.

Zhi Zeng, Cheng Zhang, Zesheng Yang, Rendong Pi, Jiaying Wu, Di Zhang, Zihan Ma, Guodong Li, Zhou Yang, Yu Xiang, Yifei (…)2026-08-11
🤖 AI

Coupled Graph--Policy Distillation for Personalized Medication Safety in Older Adults with Multimorbidity

تقدم الورقة البحثية ATLAS، وهو إطار عمل لتقطير السياسة والرسوم البيانية المقترنة، والذي يعمل على هيكلة أدلة الإرشادات وتحديث حالات المرضى ديناميكيًا لإنشاء خطط علاجية مخصصة وآمنة لكبار السن الذين يعانون من تعدد الأمراض، مُظهرًا أداءً وسلامةً فائقين على النماذج المرجعية للنماذج اللغوية الكبيرة الحالية عبر اختبارات معيارية متعددة.

Zihan Wang, Anglin Liu, Rongyi Wang, Dantong Li, Yi Lu, Siqing Yuan, Hongxia Xu, Zhongtian Long, Jintai Chen2026-08-11
🤖 machine learning

WDL-OPD: Weak-Driven On-Policy Distillation via Mixture-Constrained Co-Training

تقدم الورقة البحثية WDL-OPD، وهي طريقة تدريب مشترك مقيدة بالمزيج تعمل على تثبيت التقطير داخل السياسة من خلال التدريب المشترك لسياسة تدحرج مرجعية وسياسة تقييم مساعدة لمطابقة معلم مجمد عبر تباعد KL العكسي، محققةً أداءً هو الأفضل في مجاله في مهام الاستدلال الرياضي وتوليد الكود مقارنة بالنهج الحالية ذات السياسة الواحدة.

Zehao Chen, Gongxun Li, Tianxiang Ai, Yifei Li, Zixuan Huang, Wang Zhou, Tao Huang, Fuzhen Zhuang, Xianglong Liu, Jianxi (…)2026-08-11
🤖 machine learning

Learning to Modulate, Not to Cycle: Soft Actor---Critic Recovers Inverter-Style Heat-Pump Control

تُثبت هذه الورقة أن إضافة عقوبة تآكل الضاغط إلى دالة المكافأة تمكّن خوارزمية "ساتش" (Soft Actor-Critic) من تعلم سياسة تعديل مستمرة تقضي على دورات التشغيل والإيقاف الضارة وتقلل بشكل كبير من عدم الارتياح الحراري، في حين تفشل خوارزمية "بي بي أو" (Proximal Policy Optimisation) في القيام بذلك وتعود إلى التحكم بنظام التشغيل والإيقاف المتقطع غير الفعال.

Faizan Ahmed, Aniket Dixit, James Brusey2026-08-11
🤖 AI

RecoverFly: A Failure-Aware Reinforcement Learning Post-Training Framework for Aerial Vision-Language Navigation

تُعد RecoverFly إطار عمل للتدريب اللاحق يعتمد على التعلم المعزز المدرك للفشل، حيث يعمل على تعزيز الملاحة البصرية-اللغوية للطائرات بدون طيار من طرف إلى طرف عبر تكييف التعلم المعزز على مستوى الرمز (token-level)، وإعادة زيارة حالات الفشل، وتوظيف منهج تعليمي مع التنظيم لتحقيق أداء فائق وقدرة عالية على التعميم في معيار TravelUAV.

Boxiong Wang, Hui Kang, Geng Sun, Jiahui Li, Chao Yu, Daxin Tian2026-08-11
🤖 AI

ActBench: Self-Evolving Benchmark of Behavioral Safety in Cowork Agents

تقدم هذه الورقة ActBench، وهو معيار تقييم ذاتي التطور يتكون من 600 حالة عبر 213 سيناريو يقيم السلامة السلوكية لوكلاء العمل المشترك من خلال تحليل مسارات التنفيذ بدلاً من الاستجابات النهائية، مما يكشف عن ثغرات كبيرة في كل من النماذج اللغوية الكبيرة وأطر عمل الوكلاء من خلال إطار عمل مبتكر لتوليد الهجمات الموجهة بالمكافأة والتحقق من الأدلة المزدوجة.

Hongwei Yao, Yiming Liu, Meihui Chen, Jieling Chen, Zikun Chen, Yiling He, Wangze Ni, Cong Wang, Kui Ren2026-08-11
🤖 AI

From Prompt to Harness: Coderlet from Scratch

تقدم هذه الورقة "Coderlet"، وهو تصميم حمالة (harness) مدمج وقابل للتنفيذ يوضح الدور الحاسم لبنية النظام في الوكلاء البرمجيين من خلال تحديد الحدود وانتقالات دورة الحياة بين النموذج، والتنفيذ، والحالة، لتحويل توليدات النماذج بفعالية إلى أفعال بيئية مع تغذية راجعة مستمرة واستمرارية للحالة.

Mengfan Li2026-08-11