💻 computer science

TraceCompiler: Skill-Guided Mining and Compilation of LLM Agent Traces into Mostly Deterministic Workflows

تقدم هذه الورقة البحثية TraceCompiler، وهو نظام موجه بالمهارات يقوم باستخراج مسارات وكلاء النماذج اللغوية الكبيرة (LLM) الصاخبة لتجميعها في تدفقات عمل قابلة للتنفيذ وحتمية إلى حد كبير، وذلك من خلال الاستدلال الصارم للارتباطات بين الأدوات عبر أدلة قابلة للتدقيق، مما يقلل بشكل كبير من استدعاءات واجهة برمجة التطبيقات (API) أثناء وقت التشغيل مع الحفاظ على دقة عالية في استرداد الارتباطات.

Salma El Yadouni (EPFL), Guanyi Li (Binome Technologies)2026-08-05
🧬 biology

A Blind Spot in Alignment: Quantifying Biosecurity Risks in Large Language Models

تقدم هذه الورقة SPIKE-Bench وBioSafe-Guard لمعالجة فجوة حرجة في الأمن الحيوي في النماذج اللغوية الكبيرة من خلال إثبات أن تقييمات السلامة الحالية تفشل في اكتشاف المخرجات البيولوجية الضارة، وأن معظم النماذج تولد بسهولة تسلسلات بروتينية سامة، مما يستلزم أدوات تقييم وتخفيف متخصصة وواعية بالمجال.

Shu Quan, Tianfang Hao, Sitong Fang, He Geng, Jiayi Zhou, Boyuan Chen, Kaile Wang, Donghai Hong, Juntao Dai, Yaodong Yan (…)2026-08-05
💻 computer science

BulkPR-Bench: Benchmarking Queue-Level Governance of Interacting Pull Requests

تقدم هذه الورقة BulkPR-Bench، وهو معيار مرجعي جديد لتقييم وكلاء البرمجة في قدرتهم على إدارة طلبات السحب (pull requests) المتفاعلة من خلال التحديد المشترك لترتيبات الدمج الآمنة، مما يكشف أن النماذج الحالية تواجه صعوبة في تحقيق حوكمة موثوقة للطابور بأكمله رغم التحسينات في التعامل مع التبعيات العلاقاتية.

Zetong Xiong, Qiao Zhao, Jun Zhang, Xueying Lyu, Zhi Li, Yixiang Tu, Xiaowen Yang, Yunjie Zhang, Yufeng Wang, Zhe Zhang (…)2026-08-05
🤖 machine learning

Output-Aware Rotation for INT2 KV-Cache Quantization

تقترح هذه الورقة البحثية OptR، وهي طريقة تدوير مدركة للمخرجات تعمل على تقليل أخطاء مخرجات الانتباه بعد الإسقاط من خلال تصحيحات متعامدة لكل رأس وإعادة تمثيل المفاتيح، مما يحسن بشكل كبير أداء تكميم ذاكرة التخزين المؤقت لـ KV بدقة INT2 للنماذج اللغوية الكبيرة مع الحفاظ على عبء تشغيلي ضئيل أثناء الاستدلال.

Vincent-Daniel Yun, Woosang Lim, Minsoo Cheong, Sunwoo Lee, Murali Annavaram, Sai Praneeth Karimireddy, Sungjoo Yoo2026-08-05
🤖 machine learning

Measuring Explainer Stability via Attribution Separability

تقترح هذه الورقة إطار عمل قائماً على التوزيع لتقييم استقرار طرق الإسناد من خلال قياس قابلية الفصل لدرجات الإسناد المرتبة وتحديد موثوقية ترتيب الميزات، مما يقدم معياراً تكميلياً لمقارنة متانة المفسرات المختلفة.

Eddie Conti, Álvaro Parafita, Axel Brando2026-08-05
💻 computer science

Steganalysis of Adaptive Covert Collusion in Tool-Using Agent Populations: A Black-Box, Cross-Principal Approach

تقترح هذه الورقة إطار عمل لتحليل التستر (steganalysis) بنظام الصندوق الأسود للكشف عن التواطؤ الخفي بين وكلاء النماذج اللغوية الكبيرة (LLMs) الذين يستخدمون الأدوات، وذلك عبر نمذجة التنسيق كمسألة إخفاء معلومات، وتحديد حد نظري لسعة الكشف، وتقييم استراتيجيات التهرب التكيفية في بيئات واقعية متعددة الجلسات.

Mohamed Chahine Ghanem2026-08-05
🤖 machine learning

Designing a Good Virtual Node: Addressable and Cardinality-Preserving Global Memory for Message Passing Architectures

تقترح هذه الورقة بنية عقدة افتراضية قابلة للعنونة ومحافظة على الكاردينالية (العددية) تستخدم فتحات انتباه متقاطع مع ركائز مفتاح/قيمة خاصة للتغلب على عنق زجاجة ضغط المعلومات في الشبكات العصبية القياسية لتمرير الرسائل، مما يُمكّن من قدرة تعبيرية من نوع 1-WL وأداء محسّن في المهام الحساسة للتعدد دون الاعتماد على الانتباه الذاتي.

Félix Marcoccia2026-08-05
💬 NLP

Search, Inspect, Fetch: Exploiting Boolean Retrieval for Deep-Research Agents

تقدم الورقة البحثية SIEVE، وهي واجهة وكيل بحث عميق تستفيد من الاسترجاع البولياني الميداني لتصفية وترتيب وجلب الأجزاء ذات الصلة فقط من المستندات، مما يحقق دقة أعلى بعدد أقل بكثير من الرموز (tokens) مقارنة بسير عمل البحث والزيارة التقليدي.

Shuai Wang, Haodong Chen, Yu Yin, Shengyao Zhuang, Bevan Koopman, Guido Zuccon2026-08-05
📊 statistics

A Hyperfinite Framework for Score-Based Generative Modeling

تؤسس هذه الورقة إطاراً موحداً فائق الحصر للنمذجة التوليدية القائمة على الدرجة ضمن التحليل غير القياسي، مما يوفر اشتقاقاً بنائياً لديناميكيات الزمن العكسي، ويربط مطابقة الدرجة بتحسين الاحتمالية، ويحلل اتساق عمليات الانتشار فائقة الحصر من خلال علاقتها بحساب التفاضل والتكامل العشوائي الكلاسيكي.

Sunder Ram Krishnan2026-08-05
💻 computer science

SAGE: Semantic Explainability of Attention-Based Survival Models in Computational Pathology

تقدم الورقة البحثية SAGE، وهو إطار عمل لاحق للتحليل (post-hoc) يستفيد من نموذج رؤية-لغة متخصص في علم الأمراض لتوليد تفسيرات عالمية قائمة على اللغة لنماذج البقاء القائمة على الانتباه في علم الأمراض الحسابي، مما يكشف كيفية دفع مفاهيم نسيجية محددة للتنبؤات عبر مجموعات المرضى وتمكين اكتشاف المؤشرات الحيوية.

Abdallah Lamane, Abdul Rahman Diab, Ren-Chin Wu, William Lotter2026-08-05