🤖 AI

Auditing an AI-Generated Mathematical Proof: A Correction to a Greedy Conditioning Lemma in Quantum Parallel Repetition

تحدد هذه الورقة وتصحح خطأً محددًا في القطبية ضمن لِمّة التكييف الجشعة المستخدمة في مبرهنة تكرار متوازي أسي مزعومة للألعاب المتشابكة، مما يوضح كيف يمكن لبرهان ولّده ذكاء اصطناعي ومنطقيًا أن يحتوي على خلل منطقي حاسم بين الأحداث المتكاملة بينما يترك بيان المبرهنة الرئيسية ومعاييرها دون تغيير.

Mikołaj Sienicki, Krzysztof Sienicki2026-08-18
🤖 AI

When Agentic Executions Fail: Detecting and Localizing Runtime Faults from Telemetry

تقدم هذه الورقة AGENTCHAOSBENCH، وهي مجموعة بيانات مرجعية تتكون من 275 مسار تنفيذ وكيل (agentic execution traces) مع حقن أخطاء وقت التشغيل، لتوضيح أن الأساليب الحالية القائمة على النماذج اللغوية الكبيرة (LLM) تعاني في اكتشاف وتحديد مواقع الفشل التشغيلي المتنوع بدقة من خلال بيانات القياس عن بُعد (telemetry) وحدها.

Chenkai Zhang, Yiran Li, Yifang Tian, Michalis Bachras, Hans-Arno Jacobsen2026-08-18
💻 computer science

Automatic or Controlled? Repetition Priming Reveals Divergent Processing in Base LLMs, Instruct LLMs, and Humans

تكشف هذه الدراسة أنه بينما تعالج نماذج اللغة الأساسية الكلمات المتكررة من خلال تسهيل تلقائي ومستقر، فإن التدريب اللاحق لتحويلها إلى نماذج إرشادية ينقلها نحو معالجة محكومة وحساسة للتأخير تختلف عن الإدراك البشري، الذي يُظهر ملفاً تعريفياً هجيناً من التسهيل الحساس للتأخير دون تداخل.

Jinglei Ren, Yuyue Wang2026-08-18
🤖 machine learning

Mitigating Rubric Interference in LLM Judges via On-Policy Self-Distillation

تحدد هذه الورقة البحثية "تداخل المعايير" (rubric interference) كإشكالية في الاتساق عند تقييم النماذج اللغوية الكبيرة باستخدام معايير متعددة، وتقترح طريقة "المحاذاة ذاتية الارتكاز للمعايير" (SARA)، وهي طريقة تقطير ذاتي قائمة على السياسة المتبعة (on-policy) تستخدم أحكام المعيار الواحد كمرتكزات مستقرة لتحسين اتساق التقييم بشكل كبير عبر مجموعات البيانات وعائلات النماذج دون الحاجة إلى إشراف خارجي.

Dingyao Yu, Tong Zhang, Yutao Mou, Yunxiao Zhang, Wei Ye, Shikun Zhang2026-08-18
💻 computer science

Identifying Harm in Personalized, Generative AI Systems Requires User-Centered Auditing at the Interaction Level

تجادل هذه الورقة الموقفية بأن أساليب التدقيق التقليدية والثابتة تفشل في رصد الأضرار الناشئة والمتطورة لأنظمة الذكاء الاصطنا Generative التوليدي المخصصة، مما يستوجب التحول نحو نهج يرتكز على المستخدم وعلى مستوى التفاعل، يعترف بالضرر كعملية تكيفية وتعددية.

Hannah Cha2026-08-18
💻 computer science

Domain Agnostic Text Redaction from Natural Language Rules using Instruction Tuning

تقدم هذه الورقة إطار عمل لتنقيح النصوص يتميز بالقدرة على التفسير وعدم الارتباط بمجال محدد، حيث يستفيد من النماذج اللغوية الضبطية (instruction-tuned) لتحديد المعلومات الحساسة وتنقيحها بناءً على قواعد لغوية طبيعية يحددها المستخدم، مما يوفر مبررات شفافة لكل إجراء لضمان القابلية للتدقيق والدقة العالية في التطبيقات الحرجة مثل الوثائق القانونية والطبية.

Aravindhan Arunagiri, Ayaan Khan, Udayaadithya Avadhanam, SaiBarath Sundar2026-08-18
🤖 AI

A Comprehensive Survey of Wireless Foundation Models for AI-Native 6G Networks

تقدم هذه الدراسة مراجعة شاملة وموحدة للنماذج اللغوية الكبيرة اللاسلكية لشبكات الجيل السادس (6G) القائمة على الذكاء الاصطناعي، حيث تضع تصنيفاً للبنى الهيكلية ونماذج التدريب مع تحليل تطبيقاتها وتحدياتها واتجاهات البحث المستقبلية لتمكين ذكاء لاسلكي قابل للتوسع والتحويل.

Naveed Khan, Besan Al Sbeihi, Maryam Alshehhi, Nasir Saeed2026-08-18
🤖 AI

Synchronized Logit Steering: Real-world Steganography

تقدم هذه الورقة البحثية "توجيه اللوجيت المتزامن" (SLS)، وهو مخطط إخفاء معلومات حتمي للنماذج اللغوية الكبيرة يتيح اتصالات خفية وغير مرتبطة بنص التلقين، وذلك عبر اشتقاق توزيع لوجيت مشترك من المخرجات المولدة نفسها، مما يحقق كثافة معلوماتية عالية وتخفياً إحصائياً دون الحاجة إلى أن يتشارك المرسل والمستقبل سياق نص التلقين الأصلي.

Andrew Rufail, Aadi Dash, Onir Narahari, Ethan Mui, Mahi Gajare, Prakhar Tiwari, Shrija Makapothula, Nick Cui2026-08-18
💻 computer science

Equilibrium Forcing: Adaptive Video Generation Without Noise Conditioning

تقدم هذه الورقة البحثية "فرض التوازن" (Equilibrium Forcing - EqF)، وهو إطار عمل مبتكر لتوليد الفيديو ذاتي الانحدار يلغي اشتراط مستوى الضجيج لفصل تعلم إزالة الضجيج عن عملية أخذ العينات، مما يتيح استدلالاً تكيفياً مغلق الحلقة يحسن جودة الفيديو واتساقه بشكل كبير مقارنة بالطرق القياسية.

Hansen Jin Lillemark, Alex Rojas, Zachary Novack, Runqian Wang, Yilun Du, Yian Ma, Taylor Berg-Kirkpatrick, Rose Yu2026-08-18
🤖 AI

Semantic Uncertainty-Guided Orchestration in Hierarchical Multi-Agent Systems

تقدم هذه الورقة البحثية HASSUM، وهو إطار عمل عام للأنظمة متعددة الوكلاء الهرمية يستفيد من الإنتروبيا الدلالية والكثافة لتقدير عدم اليقين على المستوى الدلالي، مما يتيح استراتيجيات تنسيق تكيفية تعمل على تحسين الموثوقية وتقليل الهلوسة بشكل كبير في مهام الاستدلال المعقدة مقارنة بالتنسيق التقليدي ذي النمط الثابت.

John Knowlton, Aritra Guha, Risto Miikkulainen2026-08-18