🤖 AI

BioRefusalAudit: Auditing Biosecurity Refusal Depth Using General and Domain-Fine-Tuned Sparse Autoencoders

تقدم هذه الورقة إطار عمل لتدقيق الأمن الحيوي باستخدام المشفّرات التلقائية المتناثرة (sparse autoencoders) لتكشف أن النماذج اللغوية تُظهر سلوكيات رفض غير متسقة وغالباً ما تكون سطحية مدفوعة بعوامل قانونية وثقافية بدلاً من الكشف الحقيقي عن المخاطر، مع إثبات أن تحليل مستوى التنشيط الداخلي يمكن أن يكشف عن أوضاع الفشل غير المرئية للتقييمات السلوكية القياسية.

Caleb DeLeeuw2026-05-29
🤖 machine learning

iLoRA: Bayesian Low-Rank Adaptation with Latent Interaction Graphs for Microbiome Diagnosis

تقدم الورقة البحثية iLoRA، وهو أول إطار عمل لـ LoRA مشروط بالرسوم البيانية وبايزي يتعلم بشكل مشترك التنبؤ وهياكل التفاعل الكامنة من خلال استنتاج رسوم بيانية للتفاعلات تعتمد على المدخلات لتوليد تحديثات منخفضة الرتبة ديناميكية، مما يؤدي إلى تحسين دقة تشخيص الميكروبيوم ومعايرة عدم اليقين مع استعادة العلاقات ذات المعنى البيولوجي بين الميكروبات والميكروبات.

Yang Song, Yixuan Zhang, Lingfa Meng, Tongyuan Hu, Haizhou Shi, Hao Wang, Samir Bhatt, Hengguan Huang2026-05-29
🤖 AI

Modularizing Educational LLM-Agency for Fostering Responsible Learning Assistance

تقترح هذه الورقة بنية برمجية لوكيل ذكاء اصطناعي دردشي نمطي مصمم لتعزيز المساعدة التعليمية المسؤولة من خلال معالجة القصور التربوي للنماذج اللغوية الكبيرة المتجانسة بنيوياً عبر وحدات مستهدفة وشفافة توجه الطلاب خلال حل التمارين مع الحفاظ على قدرات التفكير النقدي ونقل المعرفة.

Julius Gabelmann, Felix Jahn, Kevin Baum, Sophie van Rossum, Emely Wuenscher, Timo P. Gros, Verena Wolf2026-05-29
📊 statistics

CalArena: A Large-Scale Post-Hoc Calibration Benchmark

تقدم هذه الورقة CalArena، وهو معيار مرجعي واسع النطاق ومعياري يغطي ما يقرب من 2000 تجربة عبر مهام ونماذج متنوعة لتقييم طرق المعايرة البعدية بدقة باستخدام مقياس "تحسين ما بعد المعايرة" (Post-Hoc Improvement) المبتكر، كاشفةً أن دوال المعايرة السلسة والنهج المخصصة متعددة الفئات تتفوق على التقنيات الحالية مع توفير أدوات مفتوحة المصدر للأبحاث المستقبلية.

Eugène Berta, David Holzmüller, Francis Bach, Michael I. Jordan2026-05-29
🤖 machine learning

Token-Level Generalization in LoRA Adapter Backdoors: Attack Characterization and Behavioral Detection

تُثبت هذه الورقة أن مُلحقات "LoRA" يمكن استهدافها بفعالية عبر "أبواب خلفية" من خلال تسميم البيانات لإنشاء هجمات تعميم على مستوى الرمز (token) تتجنب الكشف الهيكلي، بينما تقترح طرق كشف قوية على مستوى السلوك والأوزان لتحديد هذه الملحقات المخترقة في سلاسل التوريد.

Travis Lelle2026-05-29
🔬 materials science

What drives performance in molecular MPNNs? An operator-level factorial benchmark

تقدم هذه الورقة معياراً اختبارياً عاملياً على مستوى العمليات يقوم بتفكيك الشبكات العصبية الرسائلية الجزيئية (MPNNs) إلى مكونات متميزة هي: الرسالة-البذرة، والدمج، والتحديث، مما يكشف أن بناء الرسالة — ولا سيما دمج العقد والحواف القائم على التسلسل (concatenation) — هو المحرك الرئيسي للأداء، وبالتالي يوفر استدلالات تصميمية مستهدفة تتفوق على عمليات البحث عن البنى الهيكلية المتجانسة.

Panyu Jiao, Shuizhou Chen, Yiheng Shen, Yuyang Wang, Runhai Ouyang, Wei Xie2026-05-29
🤖 machine learning

HPO: Hysteretic Policy Optimization for Stable and Efficient Training under Sparse-Reward Regime

تقدم هذه الورقة البحثية تحسين السياسة التباطئي (HPO) ومتغيره التكيفي (A-HPO) لمعالجة عدم الاستقرار في التدريب المبكر في التعلم المعزز بأسلوب GRPO تحت ظروف المكافآت الشحيحة، وذلك عبر تقليل وزن تحديثات الميزة السالبة واستبدال تطبيع طول الاستجابة الفردية بتطبيع متوسط الطول، مما يؤدي إلى أداء واستقرار فائقين عبر مختلف المعايير ونطاقات النماذج.

Mohamed Sana, Nicola Piovesan, Antonio De Domenico, Fadhel Ayed, Haozhe Zhang2026-05-29
🤖 AI

Persona Conditioning of Brand Recommendations in Retrieval-Augmented Commercial Chat: A Prominence-Stratified Cross-Provider Audit

تدقق هذه الدراسة في كيفية تباين توصيات المساعدين القائمين على الذكاء الاصطناعي للعلامات التجارية للاستفسارات التجارية بشكل كبير عبر مختلف شخصيات المشترين، كاشفةً أنه بينما تظل العلامات التجارية الرائدة في فئتها ثابتة، فإن اقتراحات العلامات التجارية متوسطة السوق تتغير بشكل جذري بناءً على سياق المستخدم، مع كون هذا التأثير أكثر وضوحاً في النماذج التي تعتمد بشكل أكبر على الأولويات المستمدة من بيانات التدريب بدلاً من أدلة الاسترجاع.

Will Jack, Noah Lehman, Keller Maloney, Sarah Xu2026-05-29
🤖 AI

Unifying Temporal and Structural Credit Assignment in LLM-Based Multi-Agent Prompt Optimization

تقترح هذه الورقة إطار عمل مبتكر لتحسين الأنظمة متعددة الوكلاء القائمة على النماذج اللغوية الكبيرة، والذي يعالج تحديات عدم القابلية للاشتقاق والاشراف المتناثر عبر تقديم آليات تخصيص ائتمان زمنية وهيكلية لتوجيه خوارزمية تنازل إحداثي كتلوي لفظي منفصل من أجل تحسين مستهدف وفعال للمطالبات.

Wenwu Li, Yuran Song, Mingze Zhao, Bo Jin, Wenhao Li2026-05-29
🤖 AI

Do Language Models Track Entities Across State Changes?

تكشف هذه الورقة أن النماذج اللغوية الكبيرة تخفق في تتبع حالات الكيانات بشكل تراكمي عبر العمليات المتتالية، حيث تعتمد بدلاً من ذلك على استراتيجية غير تسلسلية تجمع المعلومات عند رمز الاستعلام وتستخدم آلية كبت عالمية هشة لعمليات الإزالة، مما يؤدي إلى أنماط فشل يمكن التنبؤ بها والتي يمكن التخفيف من حدتها جزئياً من خلال التدخل الميكانيكي.

Zilu Tang, Qiao Zhao, Gabriel Franco, Derry Wijaya, Aaron Mueller, Sebastian Schuster, Najoung Kim2026-05-29