💬 NLP

AI Research Agents Narrow Scientific Exploration

تجد هذه الدراسة أن وكلاء أبحاث الذكاء الاصطناعي الحاليين، على الرغم من قدرتهم على توليد أفكار علمية، يميلون إلى إنتاج أعمال أكثر تركيزاً وأقل ابتكاراً وأكثر اعتماداً على إعادة دمج الأساليب القائمة مقارنة بالأبحاث التي يؤلفها البشر، مما يشير إلى أنهم أكثر ملاءمة للتوسع المحلي بدلاً من توسيع نطاق الاستكشاف العلمي.

Yixuan Tang, Yi Yang2026-05-28
💬 NLP

Skill-as-Pseudocode: Refactoring Skill Libraries to Pseudocode for LLM Agents

تقترح الورقة البحثية "المهارة ككود زائف" (Skill-as-Pseudocode - SaP)، وهي طريقة تلقائية تحول مكتبات المهارات المكتوبة بصيغة ماركداون (markdown) الحرة إلى كود زائف محدد النوع مع تحقق حتمي، مما يمكّن وكلاء النماذج اللغوية الكبيرة (LLM agents) من تحقيق معدلات نجاح أعلى بكثير وتقليل استهلاك الرموز (tokens) في اختبار ALFWorld من خلال توفير تواقيع محددة النوع ونماذج استدعاء ملموسة.

Xinze Li, Yuhang Zang, Yixin Cao, Aixin Sun2026-05-28
💬 NLP

Pressure-Testing Deception Probes in LLMs: Scaling, Robustness, and the Geometry of Deceptive Representations

تقيم هذه الورقة البحثية بشكل منهجي مجسات الخداع في عائلة نماذج Gemma 3، مظهرةً أنه بينما تنهار المجسات الخطية تحت تأثير التحولات الأسلوبية بسبب الضيق التوزيعي بدلاً من الحدود المعمارية، فإن المجسات متعددة الأبعاد المعززة بالأسلوب يمكنها استعادة الكشف شبه المثالي بقوة عبر مختلف المقاييس من خلال الاستفضاء بالميزات الموزعة دون العتبة.

Sachin Kumar2026-05-28
💬 NLP

Semantic Flow Regularization: Teaching LLMs to Generate Diverse Yet Coherent Responses

تقدم هذه الورقة البحثية "تنظيم التدفق الدلالي" (Semantic Flow Regularization - SFR)، وهو هدف تدريب خفيف الوزن يخفف من حدة "انهيار الأنماط المتعددة" (Cross-Style Collapse) في النماذج اللغوية الكبيرة التي تم ضبطها بدقة، وذلك عبر الإشراف على التدفق الدلالي باستخدام مطابقة التدفق الشرطي، مما يعزز بشكل كبير تنوع المخرجات، ودقة الأسلوب، والأداء في كل من مهام الحوار والبرمجة دون زيادة تكاليف الاستدلال.

Kerui Peng, Feifei Li, Xingyu Fan, Wenhui Que2026-05-28
💬 NLP

KVoiceBench, KOpenAudioBench, and KMMAU: Agent-Driven Korean Speech Benchmarks for Evaluating SpeechLMs

تقدم هذه الورقة إطارين عمل بشريين-آليين لبناء معايير مرجعية للكلام باللغة المستهدفة للتغلب على قيود التقييم المتمحور حول اللغة الإنجليزية، مما أدى إلى إصدار ثلاث مجموعات بيانات كورية (KVoiceBench وKOpenAudioBench وKMMAU) تكشف عن فجوات كبيرة ونقاط ضعف تكميلية في نماذج اللغات الكلامية (SpeechLMs) الحديثة عند تقييمها في مهام الأسئلة والأجوبة المنطوقة باللغة الكورية وفهم الصوت.

Haechan Kim, Seungjun Chung, Inkyu Park, Jihoo Lee, Jonghyun Lee2026-05-28
💬 NLP

Where Does Toxicity Live? Mechanistic Localization and Targeted Suppression in Language Models

تقدم هذه الورقة Meow2X وTRNE، وهما إطاران عمل لا يتطلبان إعادة التدريب يعملان على تحديد موقع السمية في طبقات MLP المبكرة لبعض النماذج اللغوية عبر تحليل التنشيط، وكبحها من خلال التوسع أثناء الاستدلال أو تعديلات طفيفة في الأوزان، مما يحقق تحسينات مستمرة في السلامة دون المساس بجودة اللغة.

Himanshu Beniwal, Mayank Singh2026-05-28
💬 NLP

Integrated and Cross-Architecture Interpretation of LLM Reasoning

تقدم هذه الورقة إطار عمل الاستدلال المتكامل عبر البنى الهيكلية (IAR)، والذي يجمع بين تحليل ذروة المعلومات المتبادلة المعاير بنطاق التردد مع تداخل نسبة التفكير العميق ومقاييس استقرار جاكارد لتوفير منهجية موحدة وقابلة للتعميم لتفسير أنماط الاستدلال عبر مختلف بنيات النماذج اللغوية الكبيرة والمجالات.

Leonardo Matthew Yauw, Wei-Bin Kou, Yujiu Yang2026-05-28
💬 NLP

MemGuard: Preventing Memory Contamination in Long-Term Memory-Augmented Large Language Models

يُعد MemGuard إطار عمل للذاكرة مدركاً للأنواع يمنع تلوث الذاكرة غير المتجانس في النماذج اللغوية الكبيرة المعززة بالذاكرة طويلة الأمد من خلال تعيين أدوار وظيفية صريحة للذكريات وتكوين الأدلة بشكل انتقائي، مما يحسن الموثوقية وكفاءة الاسترجاع بشكل كبير.

Hyeonjeong Ha, Jeonghwan Kim, Cheng Qian, Jiayu Liu, William M. Campbell, Yue Wu, Yuji Zhang, Kathleen McKeown, Dilek Ha (…)2026-05-28
💬 NLP

KSAFE-MM: A Multimodal Safety Benchmark via Localized Contextualization for Korean Cultural Risks

تقدم هذه الورقة البحثية KSAFE-MM، وهو معيار سلامة متعدد الوسائط ومبتكر صُمم لتقييم المخاطر الثقافية الكورية من خلال الجمع بين نقاط الضعف المشتركة عالميًا وتلك الخاصة بالثقافة، مما يكشف أن النماذج الرائدة أكثر عرضة بشكل كبير لهجمات كسر الحماية القائمة على الثقافة مع مواجهة مقايضة بين السلامة والرفض المفرط.

Yongwoo Kim, Sojung An, Yunjin Park, Jungwon Yoon, Dujin Lee, HyunBeom Cho, Jaewon Lee, Wonhyuk Lee, Youngchol Kim, Jeon (…)2026-05-28
💬 NLP

ROSD: Reflective On-Policy Self-Distillation for Language Model Reasoning across Domains

تقدم هذه الورقة البحثية إطار عمل "التقطير الذاتي الانعكاسي داخل السياسة" (ROSD)، وهو إطار يعزز قدرة النماذج اللغوية على الاستنتاج عبر مختلف المجالات باستخدام عاكس ذاتي لتحديد مواضع الأخطاء وتوجيه عملية تقطير مستهدفة ومحددة للأخطاء، مما يتغلب على قيود الإفراط في التخصيص وضعف التعميم التي تعاني منها أساليب التقطير الذاتي الحالية داخل السياسة.

Ziqi Zhao, Xinyu Ma, Liu Yang, Yujie Feng, Daiting Shi, Jingzhou He, Xin Xin, Zhaochun Ren, Xiao-Ming Wu2026-05-28