🤖 AI

No Single Neuron of Failure: Distributed Safety Alignment Against White-Box Attacks

تقترح هذه الورقة البحثية "المحاذاة الأمنية الموزعة" (DSA)، وهي طريقة تعزز متانة النماذج اللغوية الكبيرة ضد هجمات المستوى العصبي ذات الصندوق الأبيض من خلال ترميز قدرات السلامة بشكل زائد عبر عصبونات متعددة عبر التعطيل المستهدف وتحديد الهوية الموجه بالتدرج، مما يؤدي إلى القضاء على نقاط الفشل الفردية مع الحفاظ على المنفعة العامة.

Simiao Xie, Chuancheng Shi, Shangze Li, Wenhua Wu, Fei Shen, Ying Zhou, Zhiyong Wang, Tat-Seng Chua2026-08-04
🤖 AI

Scoring Rules! Statistical and Strategic Alignment for Text Evaluation Metrics

تجادل هذه الورقة بأن مقاييس تقييم النصوص القائمة على المراجع يجب أن تكون مرتبطة إحصائياً بالتقييمات البشرية ومتينة استراتيجياً ضد التلاعب، مقترحةً إطاراً موحداً قائماً على المعلومات المتبادلة يحقق مقاومة فائقة للتلاعب مع الحفاظ في الوقت ذاته على ارتباط تنافسي مع الأحكام البشرية.

Shengwei Xu, Yuxuan Lu, Yifan Wu, Jason Hartline, Grant Schoenebeck2026-08-04
🤖 machine learning

When Replanning Becomes the Bottleneck: Budgeted Replanning for Embodied Agents

تقدم هذه الورقة إطار عمل BRACE، وهو إطار تحكم بميزانية مقترن بطريقة تقليم الرموز (E-RECAP)، والذي يخفف من اختناقات زمن الاستجابة الناتجة عن إعادة التخطيط المتكرر القائم على النماذج اللغوية الكبيرة في الوكلاء المجسدين، وذلك عبر تخصيص ميزانيات الرموز وتقليم السياقات ديناميكياً لتقليل انتهاكات أهداف مستوى الخدمة بشكل كبير مع الحفاظ على معدلات نجاح عالية للمهام.

Shuaijun Liu, Feiyang You, Xingwei Chen, Ningxin Su2026-08-04
🤖 AI

MRAFnd: Multimodal Retrieval-Augmented Framework for Zero-Shot Fake News Detection

يُعد MRAFnd إطار عمل مبتكرًا متعدد الوسائط لتعزيز استرجاع المعلومات، حيث يعمل على تحسين الكشف عن الأخبار الزائفة في ظروف عدم وجود بيانات مسبقة (zero-shot) عبر محاكاة فريق من المحللين المتعاونين لاسترجاع مقالات مشابهة سياقيًا، وإجراء استدلال برهاني ثنائي المسار، والمشاركة في مناظرة متعددة الوكلاء، مما يجعله يتفوق على الأساليب الرائدة الحالية في مجموعات البيانات المرجعية.

Lehan Zhang, Yinlei Cheng, Shiqi Hu Yiheng Zhou, Shangxi Li, Naidong Zhao2026-08-04
🤖 AI

Beyond Routing Saturation: A Long-Horizon Class-Incremental Perspective on Expert Routing in Multimodal Continual Instruction Tuning

تقدم هذه الورقة البحثية FLEX، وهو معيار مرجعي يتكون من 34 مهمة وتحدياً كبيراً يكشف عن أوجه القصور في التوجيه الخبير الحالي في الضبط الدقيق للتعليمات متعدد الوسائط بشكل مستمر عبر إزالة البصمات النصية وتوسيع آفاق المهام، مع اقتراح إطار عمل مبدئي للتعلم المتزايد للفئات يحسن دقة التوجيه والأداء العام بشكل كبير.

Huiyu Yi, Yongqi Xu, Bogang Zhang, Dunwei Tu, Xu Zhiming, Zhen-Hao Xie, Baile Xu, Furao Shen2026-08-04
🤖 AI

Where Reasoning Diverges: Localized Multi-Agent Debate

تقدم الورقة البحثية بروتوكول "المناظرة متعددة الوكلاء الموضعية" (LMAD)، وهو بروتوكول وقت الاستدلال الذي يحسن كفاءة ودقة الإجابة على الأسئلة متعددة الخطوات من خلال قصر مناظرات الوكلاء على أجزاء استدلالية متضاربة محددة بدلاً من تبادل مسارات كاملة، مما يحقق أداءً هو الأفضل في فئته عبر مختلف النماذج الأساسية.

Weijun Gao, Xiang Ding, Tiancheng Xing, Haoyang Liu2026-08-04
💬 NLP

Retrieval Augmented Biomedical Question Answering with Weak Question Recovery and Neural Reranking for BioASQ Task 14b

تقدم هذه الورقة البحثية خط العمل الخاص بفريق DS@GT ARC لـ BioASQ في المهمة 14b، والذي يدمج التوسع متعدد المصادر للاستعلام، وإعادة الترتيب العصبي، واستراتيجية استرداد الأسئلة الضعيفة المشروطة لتحسين متانة الاسترجاع وأداء MAP@10 بشكل كبير في الاستعلامات الطبية الحيوية الصعبة.

Xueying Zhao, Lee Mai, Balaji Anandganesh2026-08-04
🤖 AI

MineGrad: Gradient Inversion Attacks on LoRA Fine-Tuning

تقدم هذه الورقة MineGrad، وهو هجوم تحليل عكس التدرج يُمكّن خادمًا خبيثًا من إعادة بناء بيانات مستخدم خاصة عالية الدقة من تدرجات الضبط الدقيق لتقنية LoRA عبر استغلال نموذج مدرب مسبقًا ومسموم، مما يكشف بفعالية عن ثغرات خصوصية حرجة في التعلم الاتحادي كفء المعلمات عبر كل من مهام اللغة والرؤية.

Hasin Us Sami, Swapneel Sen, Basak Guler2026-08-04
🤖 machine learning

Question Begets Question: Self-Evolving Curriculum for Reinforcement Fine-Tuning on Competition Mathematics

تقدم هذه الورقة البحثية "السؤال يولد سؤالاً" (QbQ)، وهو منهج تعليمي ذاتي التطور يعمل بشكل تكراري على توليد متغيرات للمسائل من نقاط القوة الحالية للنموذج للتغلب على ندرة البيانات ومحدودية مسارات الاستدلال، مما نجح في كسر مستويات الأداء الثابتة في الضبط الدقيق للرياضيات التنافسية عبر تحقيق درجة 16.5% في مقياس pass@1 على اختبار AIME.

Longtian Bao, Jianyou Wang, Yang Zhang, Youze Zheng, Ramamohan Paturi2026-08-04
🤖 AI

Securing Agentic AI: From Per-Action Checks to Trajectory Assurance

تحدد هذه الورقة خارطة طريق أمنية شاملة للوكلاء المستقلين، محاججةً بأن السلامة يجب أن تنتقل من التحقق من الأفعال الفردية إلى ضمان سلامة مسارات السلوك الكاملة عبر كامل المكدس الوكيل، بدءاً من مدخلات الوكيل الواحد وصولاً إلى التفويض متعدد الوكلاء ومصدر سلسلة التوريد على مستوى النظام.

Alireza Lotfi, Subangkar Karmaker Shanto, Imtiaz Karim, Elisa Bertino2026-08-04