🤖 AI

Improving Collaborative Storytelling with a Multi-Agent Framework Based on Large Language Models

تقدم هذه الورقة إطار عمل متعدد الوكلاء يستخدم عملية "كاتب-محرر" تكرارية مع النماذج اللغوية الكبيرة لتعزيز سرد القصص التعاوني بين الأطفال والذكاء الاصطناعي من خلال لعبة لوحية مادية، مما يثبت أن بضع دورات من التنقيح تحسن جودة السرد بشكل كبير.

Arturo Valdivia, Paolo Burelli2026-05-29
🤖 AI

DLM-SWAI: Steering Diffusion Language Models Before They Unmask

تقترح الورقة البحثية DLM-SWAI، وهي طريقة للتحكم أثناء الاستدلال لا تتطلب تدريباً، تعمل على توجيه نماذج اللغة الانتشارية نحو أساليب وخصائص سلامة مرغوبة من خلال تحيز توزيعات الرموز (tokens) باستخدام درجات محسوبة مسبقاً أثناء عملية إزالة الضجيج، مما يحقق تحكماً فعالاً دون إعادة تدريب أو عبء حوسبي كبير.

Hyeseon An, Yo-Sub Han2026-05-29
🤖 AI

Beyond Attack Success Rate: Temporal Logit Observability for LLM Safety Failures

تقدم هذه الورقة "قابلية مراقبة اللوجيت الزمني" (TLO)، وهي أداة تشخيصية لا تتطلب تدريباً تقوم بتحليل أنماط اللوجيت الزمني أثناء عملية فك التشفير للتمييز بين أوضاع الفشل المختلفة لعمليات كسر حماية النماذج اللغوية الكبيرة (LLM jailbreaks)—مما يوفر رؤى أعمق حول السلامة مقارنة بمقاييس معدل نجاح الهجوم التقليدية، ويُمكّن من الإيقاف المبكر الفعال دون إنذارات كاذبة.

Junyoung Park, Sunghwan Park, Seongyong Ju, Jaewoo Lee2026-05-29
🤖 AI

Think Fast, Talk Smart: Partitioning Deterministic and Neural Computation for Structured Health Text Generation

تقترح ورقة "فكر بسرعة، وتحدث بذكاء" بنية هجينة لتوليد النصوص الصحية المهيكلة، تقوم بتفويض تحليل البيانات المتكرر إلى كود برمجي حتمي وتكتفي بتحديد دور النماذج اللغوية الكبيرة في التعبير المحدود عن الحقائق التي تم التحقق منها، مما يثبت أن هذا النهج يقلل بشكل كبير من الأخطاء الرقمية وأخطاء الامتثال مع خفض التكاليف مقارنة بالنماذج المرجعية التوليدية بالكامل.

Kai-Chen Cheng, Haejun Han, David Q. Sun2026-05-29
🤖 AI

TRACE: Toulmin-based Reasoning Assessment through Constructive Elements for LLM CoT Evaluation

تقدم الورقة البحثية TRACE، وهو مقياس تقييم مبتكر يقيم الجودة الهيكلية لتسلسل التفكير (Chain-of-Thought) في النماذج اللغوية الكبيرة من خلال دمج نظرية تولمين في الحجاج وإطار فلافيل للميتا-معرفة، مبرهنةً على ارتباط قوي بدقة المعايير المرجعية وفعالية كإشارة مكافأة للتعلم التعزيزي.

Yundong Kim, Heyoung Yang2026-05-29
🤖 AI

OccamToken: Efficient VLM Inference with Training-Free and Budget-Adaptive Token Pruning

يُعد OccamToken إطار عمل متكيف مع الميزانية ولا يتطلب تدريباً، يعمل على تحسين كفاءة استنتاج النماذج البصرية اللغوية عبر استبدال ترتيب الرموز المطلق الهش باختبار أدلة نسبي مرتكز على السجلات، مما يتيح ضغطاً فائقاً للرموز (على سبيل المثال، تقليل 2,880 رمزاً إلى حوالي 40 رمزاً) مع الحفاظ على أكثر من 93% من الدقة الأصلية.

Geng Li, Guohao Chen, Ting Chen, Shilin Shan, Kuangji Zuo, Bofan Lyu, Tuo An, Gen Li, Jianfei Yang2026-05-29
🤖 machine learning

Opir: Efficient Multi-Task Safety Classification for Toxicity, Jailbreaks, Hate Speech, and Harmful Content

تقدم هذه الورقة البحثية Opir، وهي عائلة من نماذج الحماية القائمة على المشفرات متعددة المهام والفعالة والمبنية على بنية GLiClass، والتي تحقق أداءً تنافسياً في تصنيف السلامة عبر كشف السمية، ومحاولات الاختراق (jailbreaks)، والمحتوى الضار، مع الحفاظ على بصمة نشر أصغر بكثير من أنظمة الحماية الضخمة الحالية.

Ihor Stepanov, Aleksandr Smechov2026-05-29
🤖 AI

GRASP: Gated Regression-Aware Skill Proposer for Self-Improving LLM Agents

يُعد GRASP إطار عمل للتحسين الذاتي لوكلاء النماذج اللغوية الكبيرة (LLM)، حيث يقوم بتحديث مكتبة مهارات محدودة بشكل تكراري من خلال قبول مُقيد بناءً على ميزانية تراجع صارمة، مما يعزز الأداء بشكل كبير في المعايير المرجعية السريرية وغير السريرية المنظمة مع منع تدهور السلوكيات المتعلمة سابقاً.

Johannes Moll, Jean-Philippe Corbeil, Jiazhen Pan, Martin Hadamitzky, Daniel Rueckert, Lisa Adams, Keno Bressem2026-05-29
🤖 AI

From Prompts to Context: An Ontology-Driven Framework for Human-Generative AI Collaboration

تقدم هذه الورقة "من المطالبات إلى السياق"، وهو إطار عمل قائم على الأنطولوجيا يعزز الثقة، والتتبع، والمساءلة في التعاون بين الإنسان والذكاء الاصطناعي التوليدي من خلال تحويل تفاعلات المطالبة والاستجابة العابرة إلى آثار تعاون مهيكلة وقابلة للاستعلام عبر أنطولوجيا تعاون السياق للذكاء الاصطناعي (CCAI).

Ngoc Luyen Le, Marie-Hélène Abel, Bertrand Laforge2026-05-29
🤖 AI

NICE: A Theory-Grounded Diagnostic Benchmark for Social Intelligence of LLMs

تقدم هذه الورقة NICE، وهو معيار تشخيصي قائم على نظرية يتكون من 137 بندًا عبر 11 بُعدًا لتقييم الذكاء الاجتماعي للنماذج اللغوية الكبيرة، كاشفًا أنه بينما تحقق هذه النماذج دقة إجمالية عالية، فإنها تظهر نقاط ضعف مستمرة في جوانب تواصل محددة مثل التفاعل متعدد الأدوار، والإشارات غير اللفظية، والتزامن.

Yunjin Qi, Zhaojun Jiang, Xuan Wu, Hanxi Pan, Yixuan Wang, Yanfang Liu, Xiang Ji, Churu Yu, Chunyuan Zheng, Yingze Chen (…)2026-05-29