🤖 machine learning

TaxDistill: Improving Metagenomic Taxonomic Annotation via Distilled Genomic Foundation Models

يُعد TaxDistill إطار عمل لتقطير المعرفة يستفيد من نموذج جينومي تأسيسي ضخم (GenomeOcean) لتوليد تسميات ناعمة لتدريب شبكة طالب خفيفة الوزن، مما يقلل من الضجيج الناتج عن الطرق التقليدية القائمة على التشابه ويحسن بشكل كبير من دقة التصنيف التصنيفي للميتاجينوم عبر مجموعات بيانات متنوعة.

Rongye Ye, Lun Li, Zheng Luo, Yiran Zhan, Shuhui Song2026-05-29
🤖 machine learning

Pre-Registering the Detectable Effect: A Paired-MDE Budget for 4-bit Quantization Benchmarks, with a Pilot Audit

تقترح هذه الورقة ميزانية محافظة للحد الأدنى من التأثير القابل للكشف (MDE) مشتقة من حسابات حجم العينة الثنائية المزدوجة لمساعدة المصممين على تسجيل ادعاءات موثوقة لعمليات التكميم بـ 4 بت مسبقاً، حيث تثبت من خلال تدقيق تجريبي أن الكثير من تباين المعايير المذكور في العينات الفرعية الصغيرة هو في الواقع ضجيج ثنائي الحدين، وأن تباين قالب الأوامر غالباً ما يتجاوز تأثيرات التكميم.

Zexin Zhuang, Yanhang Li, Zhichao Fan2026-05-29
🤖 machine learning

Towards Continuous-time Causal Foundation Models

تقترح هذه الورقة نموذجاً تأسيسياً سببياً في الزمن المستمر يضمن ثبات قانون المسار تجاه جداول الملاحظة من خلال التكامل دقيق الشبكة مع الملاحظات المنفصلة، مما يظهر أداءً فائقاً مقارنة بطرق التكامل الساذجة عبر مختلف الديناميكيات غير الخطية وسيناريوهات البيانات غير المنتظمة.

Dennis Thumm, Ruben Wiedemann, Ying Chen2026-05-29
🤖 machine learning

Context Distillation as Latent Memory Management

تقترح هذه الورقة إطار عمل لتقطير السياق يعامل المعلومات السياقية كأدوات تكييف (LoRA) نمطية داخل بنك ذاكرة كامن، وذلك باستخدام آليات الاسترجاع، والتوجيه، والبوابة الذاتية لاختيار وتنشيط الذاكرات ذات الصلة بكفاءة مع تحسين المتانة وكفاءة الاستدلال.

Ziyang Zheng, Zeju Li, Xiangyu Wen, Jianyuan Zhong, Junhua Huang, Lei Chen, Mingxuan Yuan, Qiang Xu2026-05-29
💻 computer science

Echoes within the Reasoning: Stealthy and Effective Watermarking via Chain of Thought

تقترح هذه الورقة البحثية إطار عمل BiCoT، وهو إطار عمل جديد للعلامات المائية يقوم بدمج إشارات الملكية في البنية الهندسية الداخلية لتتبعات تسلسل الأفكار (Chain-of-Thought) لتحقيق كشف قوي ومتخفٍ دون المساس بدقة الاستدلال، مكملاً بمتحقق "تسجيل الفضاء الجزئي المتين" (Robust Subspace Registration) للتعامل مع سرقة النماذج وتحولات التوزيع.

Jiacheng Lu, Yiming Li, Tao Song, Weijian Wang, Wenjie Qu, Haibing Guan, Jiaheng Zhang2026-05-29
🤖 machine learning

Feature Geometry of LoRA Adapters: A Sparse Autoencoder Analysis of Representational Divergence in Fine-Tuned Language Models

تستخدم هذه الورقة البحثية المشفرات التلقائية المتناثرة (Sparse Autoencoders) لتوضيح أن الضبط الدقيق باستخدام التكيف منخفض الرتبة (LoRA) يستحث بنيات تمثيلية متميزة داخل النماذج اللغوية، والتي تكون غير متوافقة هندسياً مع قواميس الميزات سابقة التدريب، مما يشير إلى أن التحديثات الخاصة بالمهايئ تشغل مساحات فريدة جزئياً في التدفق المتبقي.

Prasanth K K2026-05-29✓ Author reviewed
🤖 machine learning

Spectral Guidance for Flexible and Efficient Control of Diffusion Models

تقدم الورقة البحثية "التوجيه الطيفي" (Spectral Guidance)، وهو إطار عمل خالٍ من التدريب يستفيد من الهندسة الجوهرية لنماذج الانتشار لتعلم أساس ذاتي التوجيه لإسقاط أي إشارات توجيه مباشرة على مسار أخذ العينات، مما يحقق دقة شرطية محسنة بشكل كبير واستدلالاً أسرع دون إعادة تدريب أو نماذج مساعدة.

Gabriel Moreira, Manuel Marques, João Paulo Costeira, Chenyan Xiong2026-05-29
🤖 machine learning

Sequential Physics-Constrained Neural Operator Forward Modeling for the Norne\textit{Norne} Reservoir System

تقدم هذه الورقة إطاراً رياضياً وحسابياً شاملاً للنمذجة البديلة باستخدام المعاملات العصبية المتسلسلة المقيدة بالفيزياء لخزان "نورني" (Norne)، والذي يجمع بين النظرية التحليلية الوظيفية، وتحليل إزاحة المتغيرات المصاحبة، وبراهين الاستقرار الطيفي لتحقيق تسريع بمقدار 104×10^4\times مقارنة بالمحاكيات التقليدية مع الحفاظ على دقة عالية عبر أفق إنتاج يمتد لـ 3298 يوماً.

Clement Etienam, Juntao Yang, Oleg Ovcharenko, Nick Luiken, Tsubasa Onishi, Nefeli Moridis, Issam Said2026-05-29
🤖 machine learning

Cycle-Space Informed Detection of Autoencoded Blind False Data Injection Attacks on Power Systems

تقترح هذه الورقة كاشف فضاء دوري (CSD) مستنداً إلى الطوبولوجيا، يستفيد من أساس الدورة الأدنى لفرض قيود هيكلية للكشف بفعالية عن هجمات حقن البيانات الكاذبة العمياء القائمة على المشفر التلقائي والمستترة التي تلتف على طرق الكشف التقليدية القائمة على البيانات، والحد من آثارها.

Xin Li, Chenhan Xiao, Jonathan Cohen, Aviad Elyashar, Yang Weng, Rami Puzis2026-05-29
🤖 machine learning

When LLM Reward Design Fails: Diagnostic-Driven Refinement for Sparse Structured RL

تقترح هذه الورقة إطار عمل للتحسين التكراري القائم على التشخيص، والذي يعامل تصميم المكافأة لنماذج اللغات الكبيرة (LLM) في مهام التعلم التعزيزي الهيكلية والمتفرقة كعملية تصحيح أخطاء، مما يثبت أن المراجعات المستهدفة الموجهة بتصنيف لأنماط الفشل تتفوق بشكل كبير على نماذج التوليد لمرة واحدة والنماذج المعتمدة على الاختيار.

Youting Wang, Yuan Tang, Bowen Liu, Xuan Liu, Dingyan Shang2026-05-29