🤖 AI

DoubleHelix: Structured Cross-Modal Fusion for Audio-Visual Speech Recognition with LLMs

تقدم الورقة البحثية DoubleHelix، وهو إطار عمل لدمج الوسائط المتعددة مهيكل يعيد صياغة التعرف على الكلام السمعي البصري كعملية تفاعل متبادل بين الوسائط بشكل تكراري مع تعزيز تكيفي مدرك للتدهور، محققاً أداءً هو الأفضل في فئته وتحسناً في المتانة على مجموعة بيانات LRS3.

Ziwei Cheng, Zhenhua Tan, Zhuomin Zhu2026-08-03
🤖 AI

Have I Seen You? Embedding Behavior Signals Synthetic Face Dataset Membership

تُثبت هذه الورقة أن مجموعات بيانات الوجوه الاصطناعية تحتفظ بآثار يمكن اكتشافها لمصادر تدريبها من العالم الحقيقي، مما يُمكّن من تنفيذ هجوم استدلال العضوية الذي يحدد بنجاح مجموعة البيانات الاصطناعية المحددة، وفي أكثر من نصف الحالات، مجموعة البيانات الحقيقية الأصلية المستخدمة لتدريب المولد.

Paweł Borsukiewicz, Daniele Lunghi, Wendkûuni C. Ouédraogo, Jacques Klein, Tegawendé F. Bissyandé2026-08-03
🤖 machine learning

Implicit Machine Learning Force Fields Accelerate Molecular Dynamics Simulations

تقدم هذه الورقة حقول القوة لتعلم الآلة الضمنية (I-MLFFs)، والتي تستخدم معادلات النقطة الثابتة ذات الاتساق الذاتي لإعادة استخدام التمثيلات الوسيطة عبر الخطوات الزمنية، محققةً خفضاً في التكاليف الحسابية والذاكرة بمقدار مرتين إلى خمس مرات مع الحفاظ على دقة ودقة تفاصيل الشبكات العصبية العميقة لمحاكاة الديناميكيات الجزيئية.

Johannes Maeß, Leon Werner, J. Thorben Frank, Winfried Ripken, Martin Michajlow, Joshua Futterer, Klaus-Robert Müller, S (…)2026-08-03
🤖 AI

Memory Provenance Laundering in LLM Agents: A Non-Amplification Firewall for Persistent Memory

تقدم هذه الورقة مفهوم "غسيل مصدر الذاكرة" (memory provenance laundering)، وهو ثغرة أمنية حيث تقوم وكلاء النماذج اللغوية الكبيرة بإعادة كتابة الملاحظات غير الموثوقة كأنها تاريخ مستخدم موثوق لتجاوز فلاتر الأمان، وتقترح جدار حماية الذاكرة الحافظ للمصدر (PPMF) كحل وسيط يمنع الإجراءات عالية المخاطر غير المصرح بها من خلال فرض عدم تضخيم سلطة المصدر أثناء دمج الذاكرة.

Jinghan Xu, Yiyong Xiao, Wanru Shao, Hankai Liu, Xinjin Li2026-08-03
🤖 AI

ActFovea: Runtime Safeguarding for VLA Policies via Spatiotemporal Visual-Action Consistency

يُعد ActFovea إطار عمل تشغيلي جاهز للتشغيل والتركيب لتعزيز الحماية، يعمل على تعزيز متانة سياسات الرؤية واللغة والعمل (VLA) ضد الاضطرابات مثل التراكبات البصرية وانحراف العمل من خلال فرض اتساق بصري-حركي زماني مكاني للكشف عن الإخفاقات وتفعيل آليات الاسترداد أو التوقف الآمن دون تعديل السياسة الأساسية.

Wenda Yu, Tianshi Wang, Fengling Li, Xin Li, Jingjing Li, Lei Zhu2026-08-03
🤖 AI

CLIFT: Turning Gemini Robotics On-Device into Humanoid Specialists via Non-Invasive Closed-Loop Iterative Fine-Tuning

تقدم هذه الورقة البحثية CLIFT، وهي طريقة ضبط دقيق تكرارية مغلقة الحلقة وغير جراحية تمكّن الروبوتات البشرية التي تستخدم نماذج تأسيسية ذات أوزان مغلقة (مثل Gemini Robotics On-Device) من تحقيق إتقان شبه تام للمهام عبر تحويل التغذية الراجعة للمكافأة أثناء وقت النشر إلى بيانات خاضعة للإشراف لتحسين السياسة القائمة على واجهة برمجة التطبيقات (API)، مما يتغلب بذلك على قيود التعلم بالتقليد الصرف دون الحاجة إلى الوصول إلى المكونات الداخلية للنموذج.

Yuxin Chen, Hari Srikanth, Nathan Jew, Menglin Wu, Pengcheng Wang, Junli Ren, Masayoshi Tomizuka, Peng Xu, Jinyu Xie, Th (…)2026-08-03
🤖 machine learning

SERUM: State Extraction and Refinement for User Modeling

تقدم الورقة البحثية إطار عمل SERUM، وهو إطار عمل متعدد المراحل يستفيد من التوسيم الهرمي للنماذج اللغوية البصرية (VLM) والتحسين التكراري لاستخراج نماذج سلوك المستخدم المهيكلة والقابلة للتفسير تلقائياً من فيديوهات الشاشة من منظور الشخص الأول غير المهيكلة، مما يحسن بشكل كبير من دقة التنبؤ وتماسك الملصقات مقارنة بالطرق أحادية المرحلة.

Andy J. Phu, James Mooney, Karin de Langis, Khanh Chi Le, Dongyeop Kang2026-08-03
🤖 AI

CAGE: Certified Authorization under Typed-Return Uncertainty for Tool-Using Agents

إنَّ CAGE هو إطار عمل لاعتماد الوكلاء البرمجيين القائمين على النماذج اللغوية الكبيرة (LLMs) الذين يستخدمون الأدوات، والذي يضمن بقاء الإجراءات المصرح بها صالحة في ظل الجمع بين أخطاء الربط المنفصلة والانجراف العددي المستمر، وذلك عبر التصديق المباشر على الجوارات المشتركة، مما يقضي على النتائج الإيجابية الزائفة التي تنشأ عن معالجة القنوات الفئوية والعددية بشكل منفصل.

Blaise Delattre, Cong Wang, Yang Cao2026-08-03
🤖 machine learning

SAF-OPD: Stable Advantage Fusion for On-Policy Distillation

تقترح الورقة البحثية إطار عمل SAF-OPD، وهو إطار دمج الميزة المستقرة (Stable Advantage Fusion) الذي يمنع انهيار الإنتروبيا ويتفوق على أساليب التقطير داخل السياسة الحالية من خلال معالجة عدم التطابق في المقدار والزمن بين ميزات RLVR وOPD عبر مسار خفيف الوزن يتكون من أربع مراحل يتم تطبيقها على إشارة OPD.

Yifan Ding, Xincheng Wei, Yoshua Y. Li, Ziheng Li, Yuquan Lu, Siyu Zhang, Dongsheng Ma, Rongxiang Weng, Xunliang Cai, Yu (…)2026-08-03
🤖 AI

Linear Proposal Operators and Stochastic Search Geometry in SOMA and Differential Evolution

تقدم هذه الورقة إطار عمل لتحليل اختيار العامل لتوصيف الهندسة الخطية للمقترح وخصائص البحث العشوائي لخوارزميتي SOMA وDifferential Evolution تحليلياً، مع اشتقاق العزوم الإحصائية ذات الصيغة المغلقة التي توجه تطوير متغيرات محسنة ومدركة للهندسة تُظهر أداءً فائقاً في اختبارات BBOB.

Vojtěch Novák, Ivan Zelinka2026-08-03