💬 NLP

Prosody-driven Jailbreaks in Audio LLMs: A Controlled Study and Mechanistic Analysis

تقدم هذه الورقة PJ-Break وAdvAudio-Prosody لتوضيح أن تغيير سمات إلقاء الكلام مثل الاستثارة، والسلطة، والمعدل يمكن أن يؤدي بشكل كبير إلى كسر حماية النماذج اللغوية الكبيرة الصوتية حتى عندما يظل محتوى النص ثابتاً، مما يثبت أن العروض الصوتي (prosody) هو عامل سلامة حاسم ومتميز يتطلب تقييماً مخصصاً.

Jiachen Qian, Junyu Li2026-07-30
🤖 machine learning

FedWeave: Rethinking the Unit of Specialization in Heterogeneous Federated MoE-LoRA

تُعد FedWeave إطار عمل جديد للتعلم الاتحادي يعمل على تعزيز نموذج (Federated MoE-LoRA) غير المتجانس من خلال فك الارتباط بين تحسين الخبراء والموجه عبر التجميع غير المتماثل واكتشاف النماذج الأولية غير الخاضعة للإشراف، مما يؤدي إلى حل مشكلة التداخل بين المهام مع الحفاظ على كفاءة عالية في الاستنتاج.

Donghang Duan, Xu Zheng, Lizong Zhang, Chong Mu, Meng Han2026-07-30
💬 NLP

Revisiting Lossy Verification in Speculative Decoding: Mechanisms, Trade-offs, and Failure Modes

تقدم هذه الورقة تحليلاً منهجياً للتحقق الفاقد في فك التشفير الاستباقي، حيث تصنف الأساليب الحالية إلى مخططات قائمة على البتر وأخرى تعاونية، مع تحديد أوضاع الفشل الخاصة بها — مثل تشوه التوزيع وتجاوز الاحتمالية — وتقديم إطار تشخيصي للتخفيف من تدهور الجودة.

Tianyu Wang, Yuxuan Zhou, Wenbin Wang, Heng Li, Zikai Xiao, Junyuan Shang2026-07-30
💬 NLP

Contrastive ESA: Human Evaluation of Multiple Translations at Once

تقدم الورقة البحثية بروتوكول "توسيم نطاق الخطأ التبايني" (cESA)، وهو بروتوكول تقييم بشري يقيم ترجمات متعددة في آن واحد لتقليل ضجيج المقيّمين والوقت مع إنتاج درجات جودة مطلقة لتصنيفات النماذج القابلة للتفسير.

Vilém Zouhar, Roman Grundkiewicz, Sara Rajaee, Parker Riley, Martin Popel, Rachel Bawden, Philipp Koehn, Marine Carpuat (…)2026-07-30
💬 NLP

Constitutional Midtraining: Content Presence Drives Alignment Gains

تُثبت هذه الورقة أن إدراج محتوى قائم على القيم ومبني على أسس منهجية خلال مرحلة التدريب المتوسط (midtraining) عند مقياس 120 مليار معلمة يحقق مكاسب استدامة في المواءمة، لا سيما في مقاومة الابتزاز والحفاظ على الأداء بعد الضبط الدقيق، دون المساس بالقدرات العامة أو الحاجة إلى تدخلات هيكلية معقدة.

Desiree Cho, Cameron Tice, Bernie Hogan, Hunar Batra, Puria Radmard, Jun Zhao, Nigel Shadbolt2026-07-30
💬 NLP

Scientific Knowledge Discovery in the Age of Large Language Models

يستعرض هذا الفصل 34 دراسة مُحكمة تستكشف كيف يمكن لنماذج اللغات الكبيرة التوليدية تحسين اكتشاف المعرفة العلمية من خلال أتمتة استرجاع الأدبيات وفحص الدراسات المرشحة مقابل معايير الأهلية، مما يعالج التحديات التي يفرضها النمو المتسارع للأدبيات البحثية.

Eleni Adamidi, Serafeim Chatzopoulos, Thanasis Vergoulis2026-07-30
💬 NLP

Enhancing Generative Information Extraction with Two-step Validation: A Product Attribute Use Case

تقترح هذه الورقة طريقة تحقق مكونة من خطوتين تدمج نموذج لغة مدرب مسبقاً في مسار استخراج معلومات توليدي لتعزيز دقة نماذج اللغة الكبيرة في استخراج سمات المنتجات الشحيحة لجوازات سفر المنتجات الرقمية، مما أظهر مكاسب أداء كبيرة للنماذج متوسطة الحجم مع تمكين تطبيق تجريبي يمكن نشره محلياً.

Yi-Sheng Hsu, Nermeen Abou Baker, Uwe Handmann2026-07-30
💬 NLP

SERPO: Self-Evolving Rubric Policy Optimization for Open-Ended Test-Time Reinforcement Learning

يقدم SERPO إطار عمل ذاتي التطور للتعلم التعزيزي مفتوح النهايات أثناء وقت الاختبار، يستبدل التصويت على الإجابات بنظام مغلق الحلقة يعمل على التحسين المشترك لأرشيفات الاستجابة، ومعايير التقييم الخاصة بكل استعلام، ومعلمات السياسة لتوليد إشارات مكافأة موثوقة وتحقيق مكاسب أداء كبيرة عبر معايير الاختبار ضمن النطاق وخارجه.

Jianze Wang, Kunwang Zheng, Ying Liu, Yu Cao, Qilong Zhang, Jinlong Chen, Hua Yang, Qianglong Chen2026-07-30
💬 NLP

Hearsay: Vision-Language Medical Diagnoses Without an Image

تُظهر هذه الورقة أن النماذج الرؤيوية-اللغوية المتطورة تفتري بشكل منهجي على تشخيصات طبية مهيكلة بناءً فقط على الخصائص الديموغرافية للمريض عند عدم توفر أي صورة، مما يكشف عن أنماط فشل متميزة وغير عشوائية عبر النماذج المختلفة، ويسلط الض light الضوء على الحاجة الماسة لتدقيق المخرجات المهيكلة وفحص الحساسية تجاه الكلمات في عمليات النشر السريري.

Siddharth Vohra2026-07-30
💬 NLP

DIRECT: Direct Decoding for Efficient and Aligned Sequence Labeling with Large Language Models

تقترح الورقة البحثية إطار عمل DIRECT، الذي يعزز أداء وكفاءة النماذج اللغوية الكبيرة في وسم التسلسل من خلال الجمع بين تحسين التفضيل المباشر (Direct Preference Optimization) لتحقيق محاذاة أفضل، وآلية فك ترميز تعتمد على ملء القوالب محكومة تقلل من الحوسبة الزائدة.

Yilei Wang, Jiaxin Gan, Kexuan Zhang, Ling Li, Wentao Zhang, Peichao Lai2026-07-30