🤖 machine learning

rl-triton: High-Performance Triton GPU Kernels for Reinforcement Learning Credit Assignment

تقدم هذه الورقة البحثية rl-triton، وهي مكتبة مفتوحة المصدر تستفيد من إطار عمل مسح ترابطي موحد مُنفذ في Triton لتسريع سبعة خوارزميات متميزة لتعيين الائتمان في التعلم التعزيزي على وحدات معالجة الرسومات، محققةً تسريعات تتراوح بين 1.6 و5.70 ضعفاً مقارنة بالنماذج المرجعية المتجهة عن طريق تقليل عبء الذاكرة وتمكين الحوسبة المتوازية بمقياس O(logT)O(\log T).

Lars Simon Zehnder2026-08-20
💬 NLP

Stability-Aware Feature Design for Robust Watermark Detection in Machine-Generated Text

تقدم هذه الورقة البحثية "درجة استقرار النمط" (PSS)، وهو إطار عمل مبتكر للكشف عن العلامات المائية يستفيد من السمات الإحصائية المحلية وديناميكيات الاستقرار عبر المتغيرات المعاد صياغتها لتحسين المتانة بشكل كبير ضد جولات متعددة من إعادة الصياغة والنصوص القصيرة، محققاً زيادة في المساحة تحت المنحنى (AUC) تتجاوز 10-15 نقطة مئوية مقارنة بالطرق الحالية مع الحفاظ على قدرة قوية على التعميم عبر مختلف النماذج والمجالات دون الحاجة إلى إعادة التدريب.

Sina Mansouri, Mohit Marvania, Abolfazl Safikhani2026-08-20
💬 NLP

StocksTalk: A Voice-Enabled Conversational Agent for Structured Query Generation over Web Data

يُعد StocksTalk وكيلًا حواريًا شفافًا يدعم التفاعل الصوتي، يقوم بتحويل الطلبات المالية المنطوقة إلى استعلامات SQL صالحة وقابلة للتنفيذ عبر الجمع بين التعرف المستمر على الكلام، واستخراج القيود المعزز بالاسترجاع، والتحقق التفاعلي من خلال العنصر البشري، وذلك للتفوق على النهج الأساسي للنماذج اللغوية الكبيرة في الدقة والاستقرار.

Akshat Parmar, Vikranth Udandarao, Abhay Shakya, Tanmay Hire, Avinash Anand, Rajiv Ratn Shah, Daniel Wang Zhengkui2026-08-20
🔢 mathematics

Optimizing Energy Efficiency and Grid Stability via Public EV Charging Flexibility

تُظهر هذه الدراسة، باستخدام بيانات واقعية من مدينة براغ، أن تحسين مرونة شحن المركبات الكهربائية العامة لتتماشى مع فترات الطلب المنخفض والإنتاج المرتفع للطاقة المتجددة يعزز بشكل كبير من كفاءة الطاقة واستقرار الشبكة، مع تقليل الحاجة إلى الخدمات المساعدة المكلفة.

Marek Miltner, Artem Bryksa, Ondřej Štogl, Daniel Vašata, Magda Friedjungová, Ram Rajagopal, Oldřich Starý2026-08-20
🤖 AI

FraudBench: Stress-Testing Policy-Grounded Banking Agents Against Adaptive Fraud

تقدم هذه الورقة FraudBench، وهو معيار اختبار تنفيذي مبتكر صُمم لاختبار قدرة الوكلاء المصرفيين القائمين على السياسات تحت الضغط في مواجهة سيناريوهات احتيال تكيفية ومعتمدة على التاريخ، وذلك عبر محاكاة التفاعلات الديناميكية بين الوكلاء والمتصلين ذوي النوايا الخبيثة عبر حالات حسابية متغيرة ووثائق سياسات داخلية.

Dheeraj Mohandas Pai, Lu Xian2026-08-20
💻 computer science

Mitigating Spectral Bias in Neural Operators for Underwater Transmission Loss Prediction

تقترح هذه الورقة إطار عمل للتعلم المتبقي الطيفي المكاني (S2RL) يعمل على تخفيف الانحياز الطيفي لمؤثرات فورييه العصبية من خلال تفكيك التنبؤ بفقدان الإرسال تحت الماء إلى انتشار طيفي عالمي وتحسين مكاني محلي، مما يحقق تنبؤات سريعة ودقيقة وذات تفاصيل دقيقة تتفوق على النماذج المرجعية الحالية.

Yifan Sun, Shikai Fang, Chao Zhang, Lei Cheng, Jianlong Li, Peter Gerstoft2026-08-20
💻 computer science

Entropy-Constrained Adaptive Stochastic Quantization

تقدم هذه الورقة إطار عمل "الكمية العشوائية التكيفية المقيدة بالإنتروبيا" (ECASQ)، وهو إطار عمل مبتكر يعمل على تحسين قيم الكمية التكيفية بشكل مشترك لتقليل متوسط مربع الخطأ تحت قيود الإنتروبيا وعدم الانحياز، مما يوفر حلاً أمثلاً للبرمجة الديناميكية وتقريباً عالي الكفاءة وصديقاً لوحدات معالجة الرسومات مع ضمانات نظرية قوية.

Ran Ben Basat, Yaniv Ben-Itzhak, Michael Mitzenmacher, Shay Vargaftik2026-08-20
💻 computer science

TokenPowerSandbox: Evidence-Gated CPU-First Screening for Energy-Aware LLM Serving

يُعد TokenPowerSandbox إطار عمل للفحص القائم على الأدلة والأولوية للمعالجة المركزية (CPU-first)، والذي يجمع بين الإسقاط القابل للتفسير والتحري المحدود عبر وحدة معالجة الرسومات (GPU) لتحقيق دقة عالية في التنبؤ بالطاقة لخدمة النماذج اللغوية الكبيرة (LLM)، مع إظهار حدود نماذج الطاقة صراحةً في اعتماد أداء زمن الاستجابة.

Chenxu Niu2026-08-20
🤖 AI

Looped Language Models Improve Compositional Tool Calling

تُثبت هذه الورقة أن النماذج اللغوية الحلقية، لا سيما عند توظيف الاستدلال التكيفي لتخصيص الحوسبة ديناميكيًا، تعزز الأداء بشكل كبير في سيناريوهات استدعاء الأدوات التركيبية من خلال التنسيق الفعال لعدة استدعاءات لواجهة برمجة التطبيقات، والحفاظ على الحالة، وإدارة التبعيات.

Andrei Cristian Popescu, Haitz Sáez de Ocáriz Borde, Pietro Liò2026-08-20
💻 computer science

Towards Reversible Forgetting: Managing Obsolete Knowledge in Continual Enterprise AI Agents

تقترح هذه الورقة "النسيان العكسي"، وهو إطار مفاهيمي ووحدة تحكم في الذاكرة التبادلية ذات الهستيرية تدير المعرفة التي عفا عليها الزمن في وكلاء الذكاء الاصطناعي للمؤسسات المستمرة عبر تنظيم الذاكرة إلى حالات نشطة، وخاملة، ومتقاعدة لمنع النقل السلبي مع تمكين إعادة التنشيط الآمن للمعرفة التي تم كبتها سابقاً عند تكرار الظروف البيئية.

Nilutpaul Sarker Yash, Tirtho Roy, Ushashi Bhattacharjee2026-08-20