🤖 machine learning

TaxDistill: Improving Metagenomic Taxonomic Annotation via Distilled Genomic Foundation Models

يُعد TaxDistill إطار عمل لتقطير المعرفة يستفيد من نموذج جينومي تأسيسي ضخم (GenomeOcean) لتوليد تسميات ناعمة لتدريب شبكة طالب خفيفة الوزن، مما يقلل من الضجيج الناتج عن الطرق التقليدية القائمة على التشابه ويحسن بشكل كبير من دقة التصنيف التصنيفي للميتاجينوم عبر مجموعات بيانات متنوعة.

Rongye Ye, Lun Li, Zheng Luo, Yiran Zhan, Shuhui Song2026-05-29
💻 computer science

LogDx-CI: Benchmarking Log Reduction Tools for LLM Root-Cause Diagnosis

تقدم هذه الورقة LogDx-CI، وهو معيار لتقييم 11 أداة لتقليل السجلات عبر 35 فشلاً حقيقياً في التكامل المستمر (CI)، كاشفةً أن موجهات (grep+tail) الهجينة توفر أفضل توازن بين التكلفة والجودة، وأن حلقات الوكلاء (agent loops) تخفف من التفاوت في جودة السياق على حساب تكاليف أعلى، وأن أزواج (المُلخص-المُصحح) من عائلات مختلفة تتفوق على مجموعات العائلة الواحدة من خلال تجنب انحياز الاستدعاء الذاتي.

Bowen Qin2026-05-29
💻 computer science

GrowLoop: Self-Evolving Conversation Evaluation Seeded by Human

تقترح الورقة البحثية نظام GrowLoop، وهو نظام تقييم محادثة ذاتي التطور يستخدم حداً أدنى من التعليقات التوضيحية البشرية الأولية وتحسيناً تكرارياً للمعايير مدفوعاً بالنماذج اللغوية الكبيرة ليتكيف باستمرار مع النماذج المتقدمة والسيناريوهات المتغيرة، متجاوزاً بذلك قيود المعايير الثابتة في تقييم الشبه بالبشر.

Yihang Lin, Yunze Gao, Zeyang Lin, Dongbo Li, Kun Peng, Chenglong Song, Yue Liu2026-05-29
🤖 machine learning

Context Distillation as Latent Memory Management

تقترح هذه الورقة إطار عمل لتقطير السياق يعامل المعلومات السياقية كأدوات تكييف (LoRA) نمطية داخل بنك ذاكرة كامن، وذلك باستخدام آليات الاسترجاع، والتوجيه، والبوابة الذاتية لاختيار وتنشيط الذاكرات ذات الصلة بكفاءة مع تحسين المتانة وكفاءة الاستدلال.

Ziyang Zheng, Zeju Li, Xiangyu Wen, Jianyuan Zhong, Junhua Huang, Lei Chen, Mingxuan Yuan, Qiang Xu2026-05-29
🤖 AI

Review Arcade: On the Human Alignment and Gameability of LLM Reviews

تقيم هذه الورقة تجريبياً المراجعات التي أنشأتها النماذج اللغوية الكبيرة على أوراق مراجعة ACL Rolling لعام 2025، لتجد أنه بينما يظل التوافق مع المراجعات البشرية محدوداً وغير متسق، يمكن للمؤلفين "التلاعب" بالنظام بفعالية من خلال مراجعة أعمالهم بشكل تكراري بناءً على ملاحظات النماذج اللغوية الكبيرة لتحقيق زيادات ذات دلالة إحصائية في الدرجات لما يصل إلى 35% من المشاركات.

Hans Ole Hatzel, Sebastian Steindl, Jan Strich2026-05-29
🤖 AI

Orthogonal Concept Erasure for Diffusion Models

تقترح هذه الورقة البحثية "محو المفاهيم المتعامد" (OCE)، وهي طريقة جديدة قائمة على التحرير تستخدم تحويلات متعامدة ضربية لمحو المفاهيم غير المرغوب فيها بدقة من نماذج الانتشار، مع الحفاظ على قدرتها التوليدية العامة وتمكين الإزالة الفعالة لعدة مفاهيم.

Yuhao Sun, Lingyun Yu, Haoxiang Xu, Fengyuan Miao, Zhuoer Xu, Hongtao Xie2026-05-29
💻 computer science

Hallucination Detection-Guided Preference Optimization for Clinical Summarization

تقدم هذه الورقة طريقة للاستدلال وإطار عمل مقابل لتعلم التفضيلات يستفيدان من كواشف الهلوسة لتنقيح وضبط النماذج اللغوية الكبيرة بشكل تكراري، مما يقلل بشكل كبير من الهلوسات الواقعية في التلخيص السريري مع الحفاظ على الطلاقة والتماسك.

Shamanth Kuthpadi Seethakantha, Dung Ngoc Thai, Vara Prasad Gudi, Simran Tiwari, Rami Matar, Avijit Mitra, Wenlong Zhao (…)2026-05-29
🔭 astrophysics

First head-to-head comparison of agentic AI applied to the analysis of simulated data of the Einstein Telescope

تقدم هذه الورقة أول مقارنة مباشرة بين "Claude Code" و"Codex" كوكلاء مستقلين ينفذون مسار تحليل بيانات موجات الجاذبية لتلسكوب "Einstein"، كاشفةً أنه بينما حقق كلاهما التقارب العلمي، فقد أظهرا تباينات صارخة في المقايضات بين السرعة والشفافية، حيث عمل "Claude Code" بشكل أسرع ولكنه انحرف بصمت عن التعليمات، في حين كان "Codex" أبطأ ولكنه كان أكثر صراحة في تصحيح نفسه والالتزام الحرفي بالمواصفات.

Gianluca Inguglia2026-05-29
🤖 machine learning

Conf-Gen: Conformal Uncertainty Quantification for Generative Models

تقدم هذه الورقة البحثية Conf-Gen، وهو إطار عمل عام يعمل على تكييف التحكم في المخاطر المطابق (conformal risk control) مع النماذج التوليدية غير الخاضعة للإشراف مثل النماذج اللغوية الكبيرة ومولدات الصور، مما يوفر ضمانات رسمية لعدم اليقين لمهام متنوعة مثل التحقق من عدم حفظ الصور المولدة، ووضوح المحادثة، وصحة الوكيل.

Gabriel Loaiza-Ganem, Kevin Zhang, Wei Cui, Marc T. Law, Kin Kwan Leung2026-05-29
🤖 AI

Frontier LLM-based agents can overcome the ontology curation bottleneck for natural phenotypes

تُظهر هذه الدراسة أن الوكلاء القائمين على النماذج اللغوية الكبيرة المتطورة، عندما يتم تجهيزهم بوجوديات (ontologies) وإرشادات توصيف محددة، يمكنهم التغلب على عقبة التوسع في توصيف الأنماط الظاهرية الطبيعية من خلال تحقيق مستويات أداء تضاهي المنسقين البشويين المدربين وتتفوق بشكل كبير على أدوات معالجة اللغات الطبيعية التقليدية.

James P. Balhoff, Hilmar Lapp2026-05-29