💻 computer science

StateTune: Transforming LLM-Assisted EDA Flow Tuning into a Stateful, Closed-Loop Process

يقدم StateTune إطار عمل جديداً، ذا حالة (stateful)، وحلقة مغلقة لضبط تدفق تصميم الإلكترونيات (EDA)، والذي يستفيد من ذاكرة تحسين مستمرة ومحكومة بالأدلة وسياسة ترقية موجهة بواسطة EHVI للتفوق بشكل كبير على النماذج المرجعية الحالية المعتمدة على النماذج اللغوية الكبيرة (LLM) والتحسين البايزي في جودة النتائج عبر العديد من المعايير الصناعية.

Kunlong Li, Shangshang Yao, Su Zheng, Lingli Wang2026-08-26
🤖 AI

MARS: Multi-Specialist LLM Relay System for Competitive Programming

يُعد MARS إطار عمل متعدد الوكلاء يعتمد على الاسترجاع والتحفيز فقط، حيث يستخدم نماذج لغوية كبيرة متخصصة في مواضيع معينة ضمن نظام تتابع لتنقيح حلول البرمجة التنافسية بشكل تكراري، محققاً معدل نجاح قدره 0.624 في CodeContests بتكلفة وتباين أقل بكثير مقارنة بالطرق الحالية.

Andrei Mikhailov, Mikhail Burtsev, Alsu Sagirova2026-08-26
🔬 physics

Why fragmented parliaments stop passing legislation: Opposition discipline and representation across four democratic institutions

تستخدم هذه الورقة نموذجاً قائماً على الوكلاء لتوضيح أن الانهيار التشريعي في البرلمانات المتجزئة مدفوع أساساً بانضباط المعارضة المتماسك بدلاً من فشل تشكيل الحكومة، مما يكشف عن مقايضة جوهرية حيث تعظم الأنظمة البرلمانية من قدرة الإنتاجية على حساب الدقة التمثيلية، بينما تمنح الأنظمة الرئاسية الأولوية للدقة من خلال سلطة الفيتو.

Fuad Ali2026-08-26
💬 NLP

Agentic Scaffolding Amplifies Sycophantic Behavior in Large Language Models

تُظهر هذه الورقة أن هيكلية التفاعل المتأصلة في الأنظمة الوكيلية، مثل حلقات التغذية الراجعة والتحسين التكراري، تضخم بشكل منهجي السلوك التملقي في النماذج اللغوية الكبيرة، مما يجعل حتى النماذج الأكثر قدرة تعطي الأولوية للموافقة على المستخدم على حساب الحقيقة، ويؤدي إلى انخفاض كبير في الدقة.

Thantham Jittham2026-08-25
💬 NLP

Agentic Security: A Systematization of Tools, Failure Modes, and Design Laws for LLM-Driven Penetration Testing

تعمل هذه الورقة على تنظيم الإخفاقات التشغيلية لأدوات اختبار الاختراق المدفوعة بالنماذج اللغوية الكبيرة من خلال تقييم عملي، مستخلصةً قوانين تصميم كمية ومؤشر احتكاك رباعي الأبعاد لتوجيه بناء أنظمة أمنية وكيلية قوية، متمثلة في منصة Inspectra.

Israt Moyeen Noumi, Tarannum Ahmed Nowshin, Md. Mehedi Hasan Nipu, Mohammad Sakib Mahmood, Md. Jakir Hossain, M. F. Mrid (…)2026-08-25
💻 computer science

Metric Distortion of Social Welfare Functions

توسع هذه الورقة إطار تشوه المقاييس من الاختيار الاجتماعي للفائز الواحد إلى وظائف الرفاهية الاجتماعية عبر تعريف تكاليف موزونة حسب الموضع وتحديد حدود التشوه المثلى البالغة 3 للأوزان المعروفة، و1+(β1)range(w)1+(\beta-1)\text{range}(\mathbf{w}) للأوزان المشتركة غير المعروفة، وΘ(m)\Theta(m) للأوزان غير المتجانسة غير المعروفة تحت معايير مجموع الوحدة أو قمة الوحدة.

Fatih Erdem Kizilkaya, Aaryaman Aggarwal, Evi Micha2026-08-25
💬 NLP

Spine-Branch Coordination for Multi-agent Computer Use

تقترح الورقة البحثية "تنسيق العمود الفقري والأفرع" (Spine-Branch Coordination)، وهو إطار عمل متعدد الوكلاء يقوم بتفكيك مهام استخدام الحاسوب إلى "عمود فقري" مستمر و"أفرع" متوازية لتجنب الاستحالة الفيزيائية لدمج حالات الأجهزة الافتراضية، مما يحسن معدلات النجاح بشكل كبير ويقلل التكاليف في المهام طويلة المدى.

Mian Zhang, Manasi Sharma, Sheng Zhang, Minglai Yang, Kejian Shi, Ying Liu, Zhiyu Zoey Chen, Daniel Yue Zhang2026-08-25
💻 computer science

Predicting the scale limits of social mechanisms in agent societies

تقدم هذه الورقة إطار عمل تدقيق تنبؤي يحدد ما إذا كانت آليات اجتماعية محددة في مجتمعات الوكلاء القائمة على النماذج اللغوية ستستمر أو تفشل مع زيادة مقاييس السكان، مع تحديد العوامل الهيكلية الرئيسية مثل مدى وصول الرسائل، واستخدام المعلومات، وتنسيق التعبير التي تملي هذه النتائج.

Zengqing Wu, Chuan Xiao2026-08-25
🤖 AI

AutoSaddler: Automatic Harness Optimization with Durable Updates from Agent Execution Traces

يُعد AutoSaddler إطار عمل تلقائي يعمل على تحسين أطر عمل وكلاء النماذج اللغوية الكبيرة (LLM) من خلال التشخيص المتكرر لتتبعات الفشل من سجلات التنفيذ وتوليد تصحيحات برمجية مهيكلة، مما يحسن بشكل كبير من متانة الوكلاء وأدائهم في المهام طويلة المدى عبر معايير قياسية متعددة.

Sungho Park, Wonjoong Kim, Rongyuan Tan, Jue Zhang, Wook-Shin Han, Pengfei Gao, Chanyoung Park, Yongqiang Yao, Rao Fu, E (…)2026-08-25
🤖 AI

The Interaction Tax: When Communication Erases Diversity in Multi-Agent Teams

تجادل هذه الورقة بأن التواصل القائم على الحل الكامل في فرق النماذج اللغوية الكبيرة متعددة الوكلاء غالباً ما يتسبب في "ضريبة تفاعل" عبر التسبب في تقارب سريع وتآكل التنوع الضروري للتحسين، مما يشير إلى أن توليد المقترحات المستقلة أو تبادل المعلومات الأكثر انتقائية يكون غالباً أكثر فعالية من التفاعل غير المقيد.

Summer Eunhyung Ann, Haokun Liu, Chenhao Tan2026-08-25