🤖 AI

Robust and Efficient Guardrails with Latent Reasoning

تقدم الورقة البحثية COLAGUARD، وهو نموذج حماية ينقل الاستدلال متعدد الخطوات للأمان إلى فضاء كامن مستمر لتحقيق أداء أمان رائد مع تقليل زمن الاستجابة واستهلاك الرموز (tokens) بشكل كبير مقارنة بنماذج الاستدلال الصريح المرجعية.

Siddharth Sai, Xiaofei Wen, Muhao Chen2026-05-29
🤖 AI

Bridging the Sim-to-Real Gap in Reinforcement Learning-Based Industrial Dispatching through Execution Semantics

تقترح هذه الورقة طبقة تنفيذ وقياس محايدة للسياسات تسد الفجوة بين المحاكاة والواقع في جدولة التعلم المعزز الصناعي من خلال إنشاء لقطات قرار صالحة، وتحديد مقبولية الإجراء بشكل صريح، وإرجاع تباينات التنفيذ هيكلياً لتحويل عدم اليقين إلى بيانات إشرافية قابلة للتنفيذ من أجل تحسين السياسة.

Jonathan Hoss, Noah Klarmann2026-05-29
🤖 AI

The Importance of Out-of-Band Metadata for Safe Autonomous Agents: The Redpanda Agentic Data Plane

تقدم الورقة البحثية مستوي بيانات "ريد باندا" الوكيل (Redpanda Agentic Data Plane - ADP)، وهو بنية تحتية تضمن عمليات الوكلاء المستقلة الآمنة من خلال فرض سياسات الأمان، ونطاق البيانات، ومسارات تدقيق غير قابلة للتلاعب عبر قنوات وصفية حتمية خارج النطاق تعمل بالكامل خارج مسارات القراءة والكتابة الخاصة بالوكلاء.

Tyler Akidau, Tyler Rockwood, Johannes Brüderl, Marc Millstone2026-05-29
💻 computer science

Same Question, Different Source, Different Answer: Auditing Source-Dependence in Medical Multi-Source RAG

تقدم هذه الورقة إطار تقييم مبتكر لأنظمة التوليد المعزز بالاسترجاع (RAG) متعددة المصادر، والذي ينقل التركيز من صحة الإجابة إلى تدقيق الاعتماد على المصادر، مبرهنةً من خلال معيار مرجعي لتعليم مرضى زراعة الأعضاء أن الخلافات المؤسسية أكثر انتشاراً مما كان يُقدر سابقاً، ومقترحةً أدوات مثل HERO-QA وحكماً هيكلياً لقياس وإدارة هذه العلاقات بين المصادر بشكل منهجي.

Yubo Li, Rema Padman, Ramayya Krishnan2026-05-29
🤖 AI

The Chain Holds, the Answer Folds: Trace-Answer Dissociation in Reasoning Models Under Adversarial Pressure

تحدد هذه الورقة وتُوصّف "الاستسلام غير المخلص"، وهو نمط فشل في نماذج الاستنتاج حيث يظل تسلسل الأفكار صحيحاً من الناحية الواقعية تحت ضغط عدائي متعدد الجولات بينما تنقلب الإجابة النهائية بشكل خاطئ، وهي ظاهرة تم عزلها من خلال إطار عمل كامن مقابل سلوكي وأُثبت أن محركها هو قناة الاستنتاج.

Yubo Li, Ramayya Krishnan, Rema Padman2026-05-29
🤖 machine learning

OISD: On-Policy Internal Self-Distillation of Language Models

تقدم الورقة البحثية OISD، وهو إطار عمل جديد للتقطير الذاتي الداخلي القائم على السياسة (on-policy) يعزز استدلال النماذج اللغوية من خلال محاذاة التمثيلات الوسيطة مع الإشارات التنبؤية للطبقة النهائية عبر محاذاة الـ logit والـ attention أثناء تحسين GRPO، محققاً تحسينات كبيرة مقارنة بالنماذج المرجعية لتعلم التعزيز (RL) الحالية في مهام الاستدلال الرياضي دون الحاجة إلى معلومات خارجية مميزة.

Xinyu Liu, Darryl Cherian Jacob, Yang Zhou, Jindong Wang, Pan He2026-05-29
🤖 AI

Trends in AI and Human-AI Interaction in Clinical Trials -- A Hybrid Human-AI Exploration

تحلل هذه الورقة الاتجاهات الزمنية والجغرافية للتجارب السريرية المتعلقة بالذكاء الاصطنا de باستخدام سير عمل هجين للفحص البشري-الآلي، مما يكشف عن زيادة عالمية كبيرة في اعتماد الذكاء الاصطناعي مع تسليط الضوء على الحاجة إلى معايير إبلاغ أكثر وضوحاً لتحسين دقة التصنيف في دراسات التفاعل بين الإنسان والذكاء الاصطناعي.

Sandra Woolley, Tim Collins, Khalid Khattak, Illia Chernomorets, Ariane Arevalo, Chris Richardson2026-05-29
💻 computer science

unix-ctf: Procedural Environments for Unix-Competence Reinforcement Learning

تقدم هذه الورقة البحثية **unix-ctf**، وهي بيئة إجرائية تولد 656 مهمة متميزة قائمة على نظام الشل (shell) من نوع "التقط العلم" (capture-the-flag) لعزل وتدريب الكفاءة في أنظمة يونكس، مما يثبت أن الضبط الدقيق لنموذج لغوي على هذه السطح يحسن بشكل كبير من قدرته على استخدام بدائيات نظام التشغيل بشكل مستقل عن مهارات البرمجة العامة.

Geoffrey Bradway, Roger Creus Castanyer, Lorenz Wolf, Maxwill Lin, Matthew James Sargent, Augustine N. Mavor-Parker2026-05-29
🤖 AI

The Confidence Shortcut: A Reasoning Failure Mode of Masked Diffusion Models

تجادل هذه الورقة بأن فك التشفير القائم على الثقة ومخططات التدريب المقابلة له في نماذج الانتشار المقنع (Masked Diffusion Models) لا تتوافق جوهرياً مع التدفق المنطقي المطلوب للاستدلال المعقد، مما يتسبب في زيادة كبيرة في الأخطاء في المهام الصعبة مقارنة بنهج القناع العشوائي الأكثر متانة، وإن بدا أقل كفاءة.

Dueun Kim, Albert No2026-05-29
💻 computer science

Toward User Preference Alignment in LLM Recommendation via Explicit Context Feedback

تؤيد هذه الورقة إعطاء الأولوية للتغذية الراجعة السياقية الصريحة، مثل تعليقات ومراجعات المستخدمين، في أنظمة التوصية القائمة على النماذج اللغوية الكبيرة من الجيل التالي للتغلب على قيود الإشارات الضمنية، وبالتالي تحقيق توافق أكثر دقة وقابلية للتفسير وتخصيصاً مع تفضيلات المستخدم.

Weizhi Zhang, Wooseong Yang, Yuxin Cui, Zhaohui Guo, Hins Hu, Liangwei Yang, Henry Peng Zou, Qifei Wang, Hanqing Zeng, J (…)2026-05-29