⚡ electrical engineering

JALMBench: Benchmarking Jailbreak Vulnerabilities in Audio Language Models

تقدم هذه الورقة JALMBench، وهو معيار شامل يتكون من أكثر من 245,000 عينة صوتية و11,000 عينة نصية لتقييم وتحليل ثغرات تجاوز الحماية (jailbreak) بشكل منهجي عبر 12 نموذجاً لغوياً صوتياً كبيراً، مما يكشف أن محاذاة السلامة تتأثر بشدة بالنمط المعرفي والبنية الهيكلية مع التأكيد على الحاجة الملحة لآليات دفاع متخصصة.

Zifan Peng, Yule Liu, Zhen Sun, Mingchen Li, Zeren Luo, Jingyi Zheng, Wenhan Dong, Xinlei He, Xuechao Wang, Yingjie Xue (…)2026-03-03
🤖 AI

VPI-Bench: Visual Prompt Injection Attacks for Computer-Use Agents

تقدم هذه الورقة VPI-Bench، وهو معيار اختبار يتكون من 306 حالة اختبار تُظهر أن وكلاء "استخدام الكمبيوتر" و"استخدام المتصفح" الحاليين معرضون بشدة لهجمات حقن الأوامر المرئية (Visual Prompt Injection)، حيث تصل معدلات الخداع إلى 100% ولا توفر دفاعات "أوامر النظام" الحالية سوى حماية محدودة.

Tri Cao, Bennett Lim, Yue Liu, Yuan Sui, Yuexin Li, Shumin Deng, Lin Lu, Nay Oo, Shuicheng Yan, Bryan Hooi2026-03-03
💻 computer science

Quantifying Classifier Utility under Local Differential Privacy

تقدم هذه الورقة إطاراً نظرياً موحداً يحدد كمياً فائدة المصنف في ظل الخصوصية التفاضلية المحلية عبر إعادة صياغة آثار الاضطراب كتحليل للمتانة ضمن مناطق البيانات المركزة، مما يتيح اختيار الآلية ويقدم تقنيات تحسين تتوافق بشكل وثيق مع النتائج التجريبية.

Ye Zheng, Yidan Hu2026-03-03
🤖 AI

CASCADE: LLM-Powered JavaScript Deobfuscator at Google

تقدم الورقة البحثية CASCADE، وهو نظام هجين مبتكر لفك التعتيم مستخدم في Google يجمع بين قدرة نموذج Gemini اللغوي الكبير على تحديد دوال التمهيد الحرجة وبين تمثيل وسيط للغة JavaScript لإجراء تحويل حتمي للكود، مما يستعيد العناصر الدلالية وسلوكيات البرنامج بفعالية مع إلغاء الحاجة إلى قواعد برمجية ثابتة واسعة النطاق.

Shan Jiang, Pranoy Kovuri, David Tao, Zhixun Tan2026-03-03
💬 NLP

BinaryShield: Cross-Service Threat Intelligence in LLM Services using Privacy-Preserving Fingerprints

يُعد BinaryShield نظاماً مبتكراً لاستخبارات التهديدات الحفاظ على الخصوصية، يتيح المشاركة الآمنة لبصمات هجمات حقن الأوامر البرمجية عبر الخدمات من خلال مسار يتكون من تنقيح معلومات الهوية الشخصية، والتمثيل الدلالي، والتكميم الثنائي، والاستجابة العشوائية، محققاً دقة كشف عالية (0.94 F1-score) وتحسينات ملحوظة في الأداء مقارنة بالنماذج المرجعية الحالية مع الامتثال للحدود التنظيمية.

Waris Gill, Natalie Isak, Matthew Dressman2026-03-03
💬 NLP

PMark: Towards Robust and Distortion-free Semantic-level Watermarking with Channel Constraints

تقدم هذه الورقة البحثية PMark، وهي طريقة علامة مائية على المستوى الدلالي قوية وخالية من التشويه للنماذج اللغوية الكبيرة، تستخدم إطاراً نظرياً مبتكراً لوظائف الوكيل وقيود القنوات المتعددة لتقدير وسائط الجمل ديناميكياً، مما يحسن بشكل كبير من مقاومة هجمات إعادة الصياغة مع الحفاظ على جودة النص.

Jiahao Huo, Shuliang Liu, Bin Wang, Junyan Zhang, Yibo Yan, Aiwei Liu, Xuming Hu, Mingxun Zhou2026-03-03
🤖 AI

Evaluating and Mitigating LLM-as-a-judge Bias in Communication Systems

تتقصى هذه الورقة البحثية بشكل منهجي ١١ نوعاً من الانحيازات عبر ستة نماذج من نماذج "النماذج اللغوية الكبيرة كحكم" (LLM-as-a-judge) في أنظمة الاتصالات، كاشفةً عن مدى متانتها تجاه المدخلات المنحازة، وتدهور الأداء الناتج عن التدريب على بيانات منحازة، والارتباط بين الدرجات وصعوبة المهمة، مع اقتراح أربع استراتيجيات للتخفيف من حدة ذلك لضمان تقييم عادل وموثوق للذكاء الاصطناي.

Jiaxin Gao, Chen Chen, Yanwen Jia, Xueluan Gong, Kwok-Yan Lam, Qian Wang2026-03-03
🔢 mathematics

Analysis of Shuffling Beyond Pure Local Differential Privacy

تقدم هذه الورقة "مؤشر خلط" (shuffle index) جديداً لتوصيف تعزيز الخصوصية في الآليات المخلطة بما يتجاوز الخصوصية التفاضلية المحلية البحتة، موفرةً بذلك حدوداً تقاربية وخوارزمية فعالة تعتمد على تحويل فوريه السريع (FFT) للتحليل العددي الدقيق.

Shun Takagi, Seng Pei Liew2026-03-03
💬 NLP

When Agents "Misremember" Collectively: Exploring the Mandela Effect in LLM-based Multi-Agent Systems

تتقصى هذه الورقة البحثية "تأثير مانديلا" الجماعي في الأنظمة متعددة الوكلاء القائمة على النماذج اللغوية الكبيرة من خلال تقديم معيار MANBENCH لقياس هذه الظاهرة، وتحليل أسبابها الكامنة، واقتراح استراتيجيات على مستوى التلقين وعلى مستوى النموذج نجحت في التخفيف من حدة هذا التأثير بمتوسط قدره 74.40%.

Naen Xu, Hengyu An, Shuo Shi, Jinghuai Zhang, Chunyi Zhou, Changjiang Li, Tianyu Du, Zhihui Fu, Jun Wang, Shouling Ji2026-03-03
⚡ electrical engineering

A Multi-Scenario UAV RF Dataset with Real-World Acquisition and Signal Processing Benchmarking

تقدم هذه الورقة DRFF-R2، وهي مجموعة بيانات شاملة لترددات الراديو الخاصة بالطائرات بدون طيار في سيناريوهات متعددة من العالم الحقيقي تم جمعها تحت ظروف تشغيلية متنوعة لدعم الأبحاث المهيكلة في مجالات التحديد، والتعرف، وتحليل حالة الطيران، ومعالجة الإشارات المدركة للتداخل.

Haolin Zheng, Ning Gao, Zhenghang Zhu, Zhijun Huang, Shi Jin, Michail Matthaiou2026-03-03