💬 NLP

COFT: Counterfactual-Conformal Decoding for Fair Chain-of-Thought Reasoning in Large Language Models

تُعد COFT طريقةً للتدريب في وقت فك التشفير، تعمل على تقليل التحيزات المجتمعية في استدلال تسلسل الأفكر (chain-of-thought) للنماذج اللغوية الكبيرة من خلال الجمع بين دمج اللوجيتات الواقعي المضاد والمعايرة المطابقة، مما يحقق تقليلاً كبيراً في التحيز مع الحفاظ على فائدة المهمة دون الحاجة إلى إعادة تدريب النموذج.

Arya Fayyazi, Mehdi Kamal, Massoud Pedram2026-06-01
💬 NLP

Same Patient, Different Words, Different Diagnosis? Evaluating Semantic Stability in Clinical LLMs

تقترح هذه الورقة إطار عمل للتحقق الدلالي ومقاييس جديدة لتقييم استقرار 16 نموذجاً من النماذج اللغوية الكبيرة، السريرية والعامة، تجاه تغيرات المطالبات التي تحافظ على المعنى، مما يكشف أن التخصص في المجال لا يضمن باستمرار تحقيق قدر أكبر من المتانة في سياقات الرعاية الصحية.

Mahdi Alkaeed, Adnan Qayyum, Nabeel Abo Kashreef, Muhammad Bilal, Junaid Qadir2026-06-01
🤖 machine learning

LARK: Learnability-Grounded Trajectory Selection for Efficient Reasoning Distillation

تقدم هذه الورقة البحثية LARK، وهو إطار عمل قائم على القابلية للتعلم يختار بكفاءة مسارات استدلال المعلم لعملية التقطير من خلال إعطاء الأولوية لتلك التي تزيد من معدل تعلم نموذج الطالب مع الحفاظ على التغطية التوزيعية، مما يجعله يتفوق على أساليب الاختيار الحالية القائمة على الاستدلال التجريبي.

Tianrun Yu, Kaixiang Zhao, Chih-Chun Chen, Amanda Hughes, Taylor W. Killian, Fenglong Ma, Weitong Zhang, Porter Jenkins2026-06-01
💬 NLP

EUDAIMONIA: Evaluating Undesirable Dynamics in AI

تقدم الورقة البحثية EUDAIMONIA، وهو معيار إرشادي وإطار عمل "كود تصميم الذكاء الاصطناعي الاجتماعي" لتقييم كيفية فشل النماذج اللغوية الكبيرة في التوافق مع رفاهية المستخدم في التفاعلات الاجتماعية، مما يكشف أن أكثر النماذج تقدماً تنتهك بشكل متكرر إرشادات السلامة المتعلقة بالحميمية الضارة والاعتمادية، مع استمرار هذه المشكلات رغم قدرات الاستنتاج الموسعة.

Jun Rui Huang, Wang Bill Zhu, Ziyi Liu, Nathanael Fast, Ravi Iyer, Robin Jia2026-06-01
🤖 AI

Structure-Induced Information for Rerooting Levin Tree Search

تقدم هذه الورقة إطار عمل لإعادة التجذير قابل للتوسع لـ "بحث شجرة ليفين" (Levin Tree Search) يستخدم مُعيدات تجذير متعلمة لتفكيك المشكلات ضمنياً إلى مهام فرعية ناعمة، مما يتغلب على الأعباء الحسابية وقيود القابلية للتوسع الناتجة عن توليد الأهداف الفرعية الصريحة مع تحقيق كفاءة تدريب عبر الإنترنت هي الأفضل في فئتها.

Jake Tuero, Michael Buro, Laurent Orseau, Levi H. S. Lelis2026-06-01
🤖 AI

Automatically Attacking Software Reverse Engineering AI Agents

تقدم هذه الورقة تقنية هجومية تستخدم توليد المطالبات القائم على الخوارزمية الجينية لاستغلال الثغرات في أدوات الهندسة العكسية المدعومة بالنماذج اللغوية الكبيرة، مما يوضح كيف يمكن للمهاجمين حقن تعليمات خفية عبر متغيرات النصوص لخداع الوكلاء الاصطناعيين لجعلهم يسيئون تفسير الملفات التنفيذية الثنائية ويتجاوزون الكشف الآلي عن البرمجيات الخبيثة.

Brian Crawford, Justin Phillips, Patrick McClure2026-06-01
💬 NLP

Human-Alignment, Calibration, and Activation Patterns in Large Language Model Uncertainty

تتقصى هذه الورقة مدى إظهار النماذج اللغوية الكبيرة لإشارات عدم يقين شبيهة بالبشر في كل من سلوكها الظاهري وتنشيطاتها الداخلية، مع فحص العلاقة بين هذا "التوافق في عدم اليقين" ومقاييس المعايرة التقليدية عبر مجموعات بيانات متنوعة وتأثير الضبط الدقيق للتعليمات.

Kyle Moore, Jesse Roberts, Daryl Watson, William Ward, Grayson Heyboer2026-06-01
🤖 AI

Investigating Detection and Obfuscation of Prompt Injection Attacks Against Software Reverse Engineering AI Agents

تبحث هذه الورقة في مدى عرضة أنظمة الهندسة العكسية للبرمجيات الوكيلية لهجمات حقن الأوامر (prompt injection) المضمنة في الكود المصدري الثنائي، وتقترح وتقيم طرقاً لكل من تعمية هذه الهجمات وكشفها في مخرجات أدوات فك التجميع (decompiler) لتأمين سير العمل السيبراني على مستوى الإنتاج.

Brian Crawford, Patrick McClure2026-06-01
🤖 AI

Healthcare Mechanisms from Policy-as-Code Search under Strategic Provider Response

تعيد هذه الورقة صياغة تصميم آليات الرعاية الصحية كمسألة تركيب برامج باستخدام بحث تطوري موجه بنماذج لغوية كبيرة وبحث محاكي متعدد الوكلاء (Medi-Sim) لنمذجة استجابات مقدمي الخدمة الاستراتيجية ديناميكيًا، مما نجح في تركيب آلية قائمة على القواعد قابلة للفحص تقضي على التشفير الزائد وتحد من رفض المرضى مع الحفاظ على الجدوى المالية.

Zihan Wang, Xiang Xu, Hongyuan Zha, Wenhao Li2026-06-01
🤖 AI

Depth-Dependent Indirect Prompt Injection in Tool-Calling ReAct Agents: Injection Depth, Payload Framing, and Turn-Budget Sensitivity

تستقصي هذه الورقة البحثية حقن الأوامر غير المباشر في وكلاء ReAct من خلال أربع دراسات مضبوطة، كاشفةً أن عمق الحقن هو عامل الخطر المهيمن الذي يتسبب في تناقص معدلات نجاح الهجوم بشكل كبير كلما ظهرت الحمولات في مراحل لاحقة من تسلسلات الأدوات، بينما ليس للإطار تأثير معنوي ولا تؤثر ميزانيات الأدوار على النتائج.

Mohammadreza Rashidi2026-06-01