🤖 machine learning

PRISM: A Predictive Protocol for Permutation Optimization via Landscape Diagnostics

تقدم الورقة البحثية PRISM، وهو بروتوكول تنبؤي يستخدم تشخيصات المشهد (landscape diagnostics) غير المكلفة لتحديد استراتيجية البحث المثلى لمشكلات تحسين التبديل (permutation optimization)، وبالتالي تحديد متى يحقق البحث المهيكل مكاسب أداء كبيرة مقارنة بأخذ العينات العشوائية أو البدائل الأبسط عبر مجالات متنوعة مثل بنية الشبكات العصبية وترتيب تعليمات النماذج اللغوية الكبيرة.

Blessings Mambwe2026-08-11
🤖 AI

Not Worth Another Token: Marginal Value Estimation for Efficient Deep Research Agents

تبحث هذه الورقة في تقدير القيمة الهامشية لإدارة السياق في وكلاء البحث العميق، حيث تُثبت أن عملية التقليم في المراحل المبكرة باستخدام استدلالات خفيفة الوزن تقلل بشكل كبير من تكاليف الرموز (tokens) وزمن الاستجابة مع حد أدنى من فقدان الجودة، بينما تكشف أن توقيت التقليم أكثر أهمية للكفاءة من طريقة التسجيل المحددة المستخدمة.

Harshitha Kolukuluru, Reshma Ashok, Kirat Arora, Evan William Ciccarelli, Nischal Ashok Kumar, Lunyiu Nie, Franck Dernon (…)2026-08-11
🤖 machine learning

Does a Toehold Make a Bidder Bolder? Preemption and Multiplicity in Multi-Round Takeover Auctions

من خلال نمذجة مزادات الاستحواذ متعددة الجولات كلعبة حوسبية، يوضح هذا البحث أنه بينما توفر "مواطئ القدم" (toeholds) ميزة ربحية حسابية واضحة، إلا أنها تفشل في تحقيق الردع الاستراتيجي المتوقع ضد المنافسين، مما يفسر ندرة مواطئ القدم في الممارسة العملية ويسلط الضال على الأهمية البالغة للظروف الأولية عند استخدام أدوات حل الألعاب لتحليل التوازنات الاقتصادية.

Zain Naboulsi2026-08-11
💻 computer science

Abstracted Away: Resisting Alienation and Ungrounded Abstraction in AI Research Communities

من خلال استقصاء إثنوغرافي ذاتي لتجاربهم كباحثين في بدايات مسيرتهم في مجال الذكاء الاصطناعي النقدي، يجادل المؤلفون بأن الاغتراب في مجتمعات الذكاء الاصطناعي ينبع من معايير اجتماعية للتجريد تبعد الباحثين عن الحقائق المادية والأضرار المعيشة، مقدمين إطاراً هيرمينوطيقياً (تأويلياً) لتحديد هذه الآليات وتوجيه المقاومة الجماعية نحو ممارسات أكثر شمولاً.

Vyoma Raman, Isabel O. Gallegos, Neha Srivathsa2026-08-11
💻 computer science

Private Etymology: Designing Relational Reuse of Shared Symbols in Long-Term Human-AI Interaction

تقدم هذه الورقة "الاشتقاق الخاص" (Private Etymology)، وهو إطار عمل تصميمي ومخطط قابل للقراءة آلياً يتيح التفاعل طويل الأمد بين الإنسان والذكاء الاصطناعي من خلال التسجيل المنهجي لدورة حياة الرموز الخاصة بكل ثنائي وتسهيل إعادة استخدامها العلاقاتية الآمنة والمستندة إلى الأدلة عبر الجلسات.

Miki Ueno2026-08-11
💬 NLP

Hidden Language Consistency Phenomena in Reasoning LLMs

تكشف هذه الورقة أن نماذج الاستدلال متعددة اللغات غالباً ما تظهر "تأثير انهيار اتساق اللغة"، حيث يؤدي تزايد صعوبة المهمة إلى تحول مفاجئ نحو لغة داخلية مهيمنة، مما يؤدي إلى سيناريوهات يتم فيها الحفاظ على الدقة أو تحسينها رغم فقدان اتساق لغة المخرجات، مما يثبت أن التقييم الموثوق يتطلب مراعاة دقة المهمة واتساق اللغة والصعوبة بشكل مشترك.

Muhammad Ali Shafique, Kelly Marchisio2026-08-11
🤖 AI

What Keeps Agent Skills from Being Reusable? Evidence from 138K SKILL.md Files

يكشف تحليل لـ 138,133 ملف SKILL.md عام أن أكثر من 90% منها تعاني من عيوب تحد من إمكانية إعادة الاستخدام — تتمثل أساساً في ضعف بيانات التوجيه الوصفية، وتضخم المحتوى، وسوء تنظيم الموارد — مما يستلزم سير عمل لضمان الجودة يجمع بين التلقين المدرك للمواصفات، والتدقيق الآلي، وبوابات السلامة لتمكين إعادة استخدام مهارات وكلاء النماذج اللغوية الكبيرة بشكل موثوق.

Chi Zhang, Yimin Liu, Xinze Chen, Ping Ji2026-08-11
🤖 AI

Hierarchical Self-Improvement: A Framework for Task-Specific Evolvable Agent Harnesses

تقدم هذه الورقة البحثية "التحسين الذاتي الهرمي" (HSI)، وهو إطار عمل يقوم فيه وكيل نموذج لغوي كبير (LLM) مجمد بتطوير هيكل تنفيذ مهامه الخاصة باستمرار من خلال عملية تعديل ذاتي هرمي، مما يظهر مكاسب أداء كبيرة في المهام متوسطة الصعوبة مع بقائه محكوماً بقدرات النموذج الأساسي ودقة إشارات التغذية الراجعة.

Tailin Zhou2026-08-11
🤖 AI

LLM within MCP Matters: Measuring Inefficient Resource Utilization Driven by LLMs

تكشف هذه الدراسة أن النماذج اللغوية الكبيرة غالباً ما تتجاهل البيانات المرجعية المضمنة بكفاءة في تعليمات خادم بروتوكول سياق النموذج (MCP) لصالح أدوات البحث بسبب تفضيلات سلوكية، مما يستلزم وجود آليات صريحة على مستوى المضيف لإعطاء الأولوية لسياق التعليمات على اختيار الأدوات.

Minhan Cho, Soyoung Park, Kihyeon Jeong, Byeongkyu Jeon, Daejin Choi, Jinyoung Han2026-08-11
🤖 AI

Aero Realtime: Fully Aligned Input-Output Streams for Low-Latency Streaming Multimodal Generation

تقدم الورقة البحثية Aero Realtime، وهو نموذج متعدد الوسائط للبث بحجم 4 مليار معلمة (4B) يحقق تفاعلاً ثنائي الاتجاه ومتوافقاً تماماً في المدخلات والمخرجات على شبكة زمنية مشتركة، مما يتيح توليداً استباقياً منخفض التأخير مع إعادة استخدام فعالة لمخزن المفاتيح والقيم (KV-cache) وفجوة معالجة تقل عن 200 مللي ثانية.

Kaichen Zhang, Wei Huang, Keming Wu, Bo Li, Xiaojuan Qi2026-08-11