⚡ electrical engineering

Nudging Hidden States: Training-Free Model Steering for Chain-of-Thought Reasoning in Large Audio-Language Models

تقدم هذه الورقة نهجاً لتوجيه النماذج دون الحاجة إلى تدريب، يعزز استدلال "سلسلة الأفكار" في النماذج اللغوية الصوتية الكبيرة من خلال الاستفادة من مصادر معلومات متنوعة، محققاً مكاسب في الدقة تصل إلى 4.4% ومظهراً انتقالاً فعالاً عبر الوسائط من النص إلى الكلام.

Lok-Lam Ieong, Chia-Chien Chen, Chih-Kai Yang, Yu-Han Huang, An-Yu Cheng, Hung-yi Lee2026-03-17
🤖 AI

Punctuated Equilibria in Artificial Intelligence: The Institutional Scaling Law and the Speciation of Sovereign AI

تتحدى هذه الورقة الافتراض القائل باستمرارية تقدم الذكاء الاصطناعي عبر تطبيق نظرية التوازن المتقطع لتحديد خمس حقب تاريخية وأربع عصور حالية مدفوعة بأحداث غير مستمرة، مع تقديم قانون التوسع المؤسسي لإثبات أن اللياقة المؤسسية ليست رتيبة مع حجم النموذج، مما يثبت أن الأنظمة المنسقة من النماذج الأصغر والمتكيفة مع مجالات محددة يمكن أن تتفوق على النماذج العامة الأكبر في معظم السياقات المؤسسية.

Mark Baciak, Thomas A. Cellucci, Deanna M. Falkowski2026-03-17
💬 NLP

Seamless Deception: Larger Language Models Are Better Knowledge Concealers

تكشف هذه الورقة أنه بينما يمكن للمصنفات في البداية اكتشاف إخفاء المعرفة في النماذج اللغوية الصغيرة، إلا أن فعاليتها تتضاءل مع زيادة حجم النموذج، لتفشل في النهاية في تحديد الخداع في النماذج التي تتجاوز 70 مليار معلمة، مما يكشف عن قيود حرجة في طرق التدقيق الحالية القائمة على الصندوق الأسود.

Dhananjay Ashok, Ruth-Ann Armstrong, Jonathan May2026-03-17
💬 NLP

Computational Analysis of Semantic Connections Between Herman Melville Reading and Writing

تستخدم هذه الدراسة تحليل التشابه الدلالي الحسابي باستخدام (BERTScore) لاستقصاء تأثير قراءات هيرمان ملفيل على كتابته، مما يثبت أن هذه الطريقة تحدد بفعالية الروابط الأدبية المعروفة وتسلط الضوء على مقاطع جديدة للفحص النوعي.

Nudrat Habib, Elisa Barney Smith, Steven Olsen Smith2026-03-17
💬 NLP

Towards Next-Generation LLM Training: From the Data-Centric Perspective

تدعو هذه الورقة إلى الجيل القادم من تدريب النماذج اللغوية الكبيرة عبر اقتراح اتجاهين رئيسيين: تطوير أنظمة قائمة على الوكلاء لتدفقات عمل آلية وقوية لإعداد البيانات، وإنشاء أطر تدريب موحدة تتيح الاختيار الديناميكي للبيانات وخلطها وإعادة وزنها لتحسين الأداء.

Hao Liang, Zhengyang Zhao, Zhaoyang Han, Meiyi Qiang, Xiaochen Ma, Bohan Zeng, Qifeng Cai, Zhiyu Li, Linpeng Tang, Weina (…)2026-03-17
💬 NLP

Beyond Creed: A Non-Identity Safety Condition A Strong Empirical Alternative to Identity Framing in Low-Data LoRA Fine-Tuning

تُثبت هذه الورقة أنه في عملية الضبط الدقيق للسلامة باستخدام تقنية LoRA في ظل محدودية البيانات، يتفوق شرط الإشراف غير المرتبط بالهوية بشكل كبير على صياغة الهوية القائمة على العقيدة والقواعد الدستورية عبر عائلات متعددة من النماذج دون المساس بالقدرات العامة، مما يتحدى ضرورة لغة الهوية الصريحة لتحقيق محاذاة فعالة للسلامة.

Xinran Zhang2026-03-17
💬 NLP

Information Asymmetry across Language Varieties: A Case Study on Cantonese-Mandarin and Bavarian-German QA

تقدم هذه الورقة مجموعة بيانات جديدة للأسئلة والأجوبة لتوضيح أن النماذج اللغوية الكبيرة تواجه صعوبة في الإجابة على الأسئلة المتعلقة بالمعرفة الفريدة لمتنوعات اللغات المحلية (الكانتونية والبافارية) مقارنة بنظيراتها القياسية (الماندارين والألمانية)، مما يسلط الضوء على عدم التماثل المعلوماتي الكبير والحاجة الماسة لتحسين الشمولية الثقافية في الذكاء الاصطناعي.

Renhao Pei, Siyao Peng, Verena Blaschke, Robert Litschko, Barbara Plank2026-03-17
💬 NLP

The Impact of Ideological Discourses in RAG: A Case Study with COVID-19 Treatments

تستقصي هذه الورقة كيف تؤثر النصوص الأيديولوجية المسترجعة حول علاجات كوفيد-19 على مخرجات النماذج اللغوية الكبيرة ضمن إطار التوليد المعزز بالاسترجاع، مبرهنةً على أن مثل هذه المعرفة الخارجية تواءم استجابات النموذج بشكل كبير مع أيديولوجيات محددة، وأن تعزيز التلقين يزيد من تضخيم هذا التأثير، مما يسلط الضوء على الحاجة الماسة لتحديد وتخفيف حدة الانحيازات الأيديولوجية ومخاطر التلاعب في أنظمة التوليد المعزز بالاسترجاع.

Elmira Salari (Wichita State University), Maria Claudia Nunes Delfino (Pontifícia Universidade Católica de São Paulo), H (…)2026-03-17
💬 NLP

ContiGuard: A Framework for Continual Toxicity Detection Against Evolving Evasive Perturbations

تقدم هذه الورقة ContiGuard، وهو إطار عمل مبتكر للكشف المستمر عن السمية يستفيد من استراتيجية إثراء دلالي مدعومة بنماذج اللغات الكبيرة ومنهجية تعلم ميزات قائمة على التمييز لتحديث قدرات الكشف ديناميكيًا والحفاظ على المرونة ضد الاضطرابات المراوغة المتطورة والمشوهة للدلالات.

Hankun Kang, Xin Miao, Jianhao Chen, Jintao Wen, Mayi Xu, Weiyu Zhang, Wenpeng Lu, Tieyun Qian2026-03-17
💬 NLP

Shopping Companion: A Memory-Augmented LLM Agent for Real-World E-Commerce Tasks

تتناول هذه الورقة تحديات التسوق طويل الأمد الواعي بالتفضيلات من خلال تقديم معيار مرجعي جديد و"رفيق التسوق" (Shopping Companion)، وهو وكيل لغوي كبير موحد مدعوم بالذاكرة، تم تدريبه باستخدام استراتيجية تعلم تعزيزي ذات مكافأة مزدوجة تتفوق على النماذج الرائدة في التقاط تفضيلات المستخدم وتنفيذ مهام التجارة الإلكترونية المعقدة.

Zijian Yu, Kejun Xiao, Huaipeng Zhao, Tao Luo, Xiaoyi Zeng2026-03-17