💻 computer science

Semantic Tracing in LLM-Based Multi-Agent Systems Using LangChain, LangGraph, and LangSmith for AI Governance

تقدم هذه الورقة إطار عمل للتتبع الدلالي للأنظمة متعددة الوكلاء القائمة على النماذج اللغوية الكبيرة باستخدام LangChain وLangGraph وLangSmith ضمن نموذج SHADOWAI-RISK الأولي، مما يثبت أن دمج التقييم الدلالي يقلل بشكل كبير من الانحراف الدلالي وانتهاكات القيود مع التسبب فقط في زيادة متوسطة في زمن الاستجابة وتكلفة محلية صفرية.

Audrey Rahimi2026-07-28
💻 computer science

From RAG to Runtime Intelligence: Design and Evaluation of a Multi-LLM Automated Learning Engine for Enterprise Knowledge Synthesis

تقدم هذه الورقة وتقيّم محرك تعلم آلي (ALE) يتجاوز أنظمة التوليد المعزز بالاسترجاع (RAG) القياسية عبر توظيف نظام متعدد النماذج اللغوية الكبيرة (multi-LLM) مُدار بنظام استرجاع هجين وسير عمل يعتمد على آلات الحالة (state-machine)، مما أظهر تحسناً ملحوظاً في الدقة الواقعية، والارتباط السياقي، وخفض معدلات الهلوسة في توليف المعرفة للمؤسسات مقارنة بالإعدادات المرجعية.

Swapnil M2026-07-28
💻 computer science

The Limits of Training Data Size in Foundation Models: An Empirical Analysis of Quality Filtering under a Fixed Token Pool

من خلال تجارب تجريبية على مجموعة ثابتة مكونة من 24 مليون رمز، تُظهر هذه الورقة أن التصفية الصارمة للجودة في ظل ميزانية حوسبة ثابتة غالبًا ما تضر بأداء النموذج عبر فرض تكرار مفرط للبيانات، في حين أن الاحتفاظ بالبيانات منخفضة الجودة والإفراط في أخذ عينات من المجموعات الفرعية عالية الجودة يحقق نتائج متفوقة أو مكافئة عبر مختلف الأهداف.

Alexander Memming2026-07-28
💻 computer science

What Counts as Compute? An Empirical Analysis of Accounting Conventions in Compute-Optimal Transformer Training

تُبين هذه الورقة أنه في حين أن تباين الاصطلاحات المحاسبية لعدّ المعلمات والحوسبة يغير بشكل كبير الأسس الملائمة لجبهة التدريب المثلى للحوسبة، إلا أن الأثر العملي الناتج على كفاءة التدريب يعد طفيفاً بسبب تسطح مشهد الخسارة، مع كون خيارات المحاسبة المحددة قابلة للتنبؤ من خلال النسب الهيكلية البسيطة.

Alexander Memming2026-07-28
💻 computer science

Bounded-Horizon Local Transformer Training on CPUs: Quality, Throughput, and Memory

تقيم هذه الورقة البحثية التدريب المحلي ذو الأفق المحدود لنماذج "ترانسفورمر" (Transformer) المكونة من 24 طبقة على مستوى البايت فوق وحدات معالجة مركزية متعددة الأنوية، حيث وجدت أنه بينما تحقق طريقة إجماع تدرج القراءة المقترحة زيادة في الإنتاجية بنسبة 38% مقارنة بالانتشار العكسي العالمي، إلا أنها تفشل في تلبية معيار عدم الدونية بنسبة 1% لجودة النموذج عبر جميع مجموعات البيانات المختبرة.

Vikram Lex2026-07-28
💻 computer science

From Forecasting Systems to Agentic Governance: A Structured Critical Review of Computational Models for Political, Economic, and Information Dynamics Structured critical review

تكشف هذه المراجعة النقدية المهيكلة أنه بينما تقدمت الأنظمة الحوسبية في قدرات معزولة مثل التنبؤ والمحاكاة، لا يوجد حالياً أي نظام موثق يتمم حلقة حوكمة تكيفية كاملة ومحققة تجريبياً تُظهر نجاح التدخل في العالم الحقيقي تحت الاستجابة الاستراتيجية، مما يسلط الض الضوء على فجوة أدلة حرجة بين الأدوات النمطية الحالية والحوكمة الوكيلية الحقيقية.

Vasiliy Znamenskiy2026-07-28
💻 computer science

Removing Noise or Introducing Bias? The Hidden Cost of MSR Filtering

تحلل هذه الدراسة 1.57 مليون مستودع من مستودعات GitHub لتثبت أن معايير التصفية الشائعة في أبحاث تنقيب مستودعات البرمجيات (MSR) تُدخل تحيزات صيانة ونظام بيئي وعلاقات جوهرية تشوه معدلات هجر المشاريع والعلاقات بين المتغيرات، وتدعو إلى التحول نحو أخذ العينات الطبقية وتحسين كشف الضجيج.

Mohit Kaushik, Jyoti Bawa2026-07-28✓ Author reviewed
💻 computer science

A Search‑Free Foundation Model for Symbolic Regression of Physical Laws

تقدم الورقة البحثية نموذج PISR، وهو نموذج تأسيسي خالٍ من البحث يستفيد من متعدد طيات (manifold) صيغ وبيانات متوافقة تباينيًا ومستوحاة من الفيزياء، ومن مطابقة التدفق لاستعادة القوانين الفيزيائية القابلة للتفسير بسرعة ودقة من البيانات، متفوقًا بذلك على الأساليب الحالية في كل من السرعة والدقة الهيكلية عبر مختلف المعايض العلمية والواقعية.

Chenxi He, Jingqiu Chen2026-07-28
💻 computer science

AI Accountability Infrastructure: Cryptographically Verifiable Decision Provenance for High-Stakes AI Systems

تقترح هذه الورقة بنية تحتية للمساءلة في مجال الذكاء الاصطناعي (AAI)، وهي إطار عمل تشفيري يستخدم سجلات متسلسلة عبر دالات التجزئة وموقعة رقمياً، بالإضافة إلى التشفير العتبي، لتمكين التحقق من طرف ثالث يحافظ على الخصوصية فيما يتعلق بمصدر قرارات ذكاء اصطناعي محددة في المجالات عالية المخاطر، مع توفير نماذج رسمية، وتحليلات للتهديدات، ومواءمات تنظيمية دون تقديم نتائج تجريبية مستحدثة.

Mezbah Uddin Rafi2026-07-28
💻 computer science

Eco-ITAD: A Real-Time Automated Hardware Diagnostics and Scope 3 ESG Compliance Framework for Sustainable E-Waste Management

تقترح هذه الورقة نظام Eco-ITAD، وهو نظام آلي يعمل في الوقت الفعلي ويستخدم لغتي Python وFlask لتشخيص حالات الأجهزة بسرعة وحساب تجنب انبعاثات الكربون من النطاق 3 (Scope 3) بناءً على إرشادات DEFRA البريطانية، مما يتيح إدارة فورية وآمنة ومتوافقة للنفايات الإلكترونية دون الحاجة إلى مرافق خارجية أو تخزين بيانات محلي.

Md Saiful Islam, Joyshree Sarkar2026-07-28