🤖 AI

Disagree to Explore, Agree to Commit: Routing-Guided Test-Time Scaling for Software Agents

تقدم هذه الورقة Risa، وهي طريقة لتوسيع نطاق الاختبار للوكلاء البرمجيين تستفيد من آثار موجه (MoE) الأصلية لتوجيه الاستكشاف المتنوع واختيار الحلول النهائية من خلال الاتفاق عند نقاط القرار الرئيسية، مما يحقق معدلات دقة محسنة على SWE-bench Verified دون الحاجة إلى حكام خارجيين أو مطابقة لسلاسل الإجابات.

Kang Chen, Junjie Nian, Yixin Cao, Yugang Jiang2026-08-25
🤖 machine learning

Joint Causal Structure and Cluster Discovery Using Variational Inference

تقترح هذه الورقة إطار عمل جديداً للاستدلال التبايني يستنتج في آن واحد مجموعات المتغيرات الكامنة وهياكلها السببية، مما يعالج قصور الطرق الحالية التي تتطلب مجموعات محددة مسبقاً، وتُظهر فعاليتها على كل من مجموعات البيانات الاصطناعية والواقعية.

Avni Rajpal, Anubhav Kumar, Rishabh Karnad, Mohammad Emtiyaz Khan, P. K. Srijith2026-08-25
📊 statistics

Spending Scarce Confirmatory PET Measurements: Target-Aligned Validation in A4/LEARN

تُثبت هذه الورقة أن تخصيص قياسات التصوير المقطعي بالإصدار البوزيتروني (PET) التأكيدية الشحيحة بناءً على استراتيجية تحقق محددة الهدف —من خلال إعطاء الأولوية للمشاركين ذوي التأثير العالي على الادعاء العلمي أو السريري المحدد بدلاً من مجرد عدم اليقين في التنبؤ— يحسن عملية توليد الأدلة لدراسات مرض الزهايمر، كما هو موضح من خلال تطبيقها على مجموعة بيانات A4/LEARN.

Eliuvish Han Cui2026-08-25
🤖 machine learning

FreKoo++: Learning Continuous Spectral Dynamics for Temporal Domain Generalization

تُعد ++FreKoo إطار عمل طيفي-ديناميكي مستمر ومبتكر يوحد ديناميكيات مود (Koopman) النمطية المستمرة مع فك التشابك الطيفي التكيفي لتحقيق تعميم في المجال الزمني يتفوق على أحدث المعايير تحت تأثير الانزياحات متعددة المقاييس المعقدة وأخذ العينات غير المنتظم، وذلك عبر نمذجة تطور المعلمات كأنماط مستمرة قابلة للتعلم وعزل الديناميكيات المهيمنة عن الضجيج تلقائياً.

En Yu, Xiaoyu Yang, Wei Duan, Guangquan Zhang, Jie Lu2026-08-25
💬 NLP

Improving Few-Step Language Flows with Untied Self-Conditioning

تقدم الورقة البحثية "الاشتراط الذاتي غير المربوط" (Untied Self-Conditioning)، وهو أداة عينات خالية من التدريب تعالج عدم التطابق بين التدريب والاستنتاج في نماذج اللغة القائمة على مطابقة التدفق، وذلك عبر فك الارتباط بين مدخلات الاشتراط الذاتي الفائضة وتقريب التنبؤات بمتوسط الخطوات، مما يحسن جودة التوليد بشكل كبير ويقلل من الحيرة عبر عدد قليل إلى العديد من خطوات أخذ العينات.

Bocheng Li, Linli Xu2026-08-25
🤖 machine learning

GAN-Diff : Coupling Pretrained WGAN-GP Features with Conditional Diffusion U-Nets

تقترح هذه الورقة البحثية GAN-Diff، وهو إطار عمل هجين يستفيد من الميزات المتوسطة لمولد WGAN-GP مدرب مسبقاً ومجمد كعنصر توجيهي (prior) لتوجيه نموذج U-Net لانتشار شرطي عبر آلية الانتباه المتقاطع (cross-attention)، محققاً تحسينات كبيرة في مهام ترميم الصور مثل إزالة الضجيج والارتقاء بالدقة (super-resolution) مع معالجة عدم استقرار التدريب الرئيسي.

Saif Ahmed, Ashadulla Hil Galib, S. M. Riaz Rahman Antu, Ahmed Faizul Haque Dhrubo, Souvik Pramanik, Mohammad Abdul Qayu (…)2026-08-25
🤖 AI

OVIBench: Benchmarking Online Video Question Answering under Interruption

تقدم هذه الورقة OVIBench، وهو أول معيار مرجعي موحد ومجموعة بيانات تدريبية مقابلة مصممة لتقييم وتحسين قدرة نماذج اللغة الرؤيوية على التعامل مع مقاطعات المستخدم الواقعية — مثل الإلغاءات، والمحفزات الخاطئة، والتصحيحات — أثناء الإجابة على الأسئلة عبر الفيديو عبر الإنترنت.

Naiming Liu, Zhiheng Wu, Shuning Wang, Tie Zhang, Bowen Liu, Tong Wang2026-08-25
🤖 machine learning

Learning from the Test: Self-Referential Differential Testing for Deep RL Agents

تقترح الورقة البحثية إطار عمل "دلتا" (Delta)، وهو إطار عمل مبتكر يعالج مشكلة "أوراكل الاختبار" (testing oracle) في التعلم التعزيزي العميق من خلال الجمع بين اختبار السلامة والتعلم التعزيزي غير المتصل لتوليد وكلاء متحدٍّين للاختبار التفاضلي، مما يساهم بفعالية في تحديد كل من إخفاقات السلامة الحرجة وأخطاء المثالية في وكلاء التعلم التعزيزي العميق.

Junda He, Jieke Shi, Zhou Yang, Mingfei Cheng, David Lo2026-08-25
💬 NLP

Register Shifts Break LLM Safety: A Bengali Benchmark with Culturally Grounded Harms

تقدم هذه الورقة BanglaSafe، وهو معيار مرجعي للغة البنغالية متجذر ثقافياً يكشف أن إخفاقات سلامة النماذج اللغوية الكبيرة مدفوعة بأساليب الكتابة الرسمية أكثر من ترجمة اللغة، حيث ثبت عدم أمان أكثر من نصف الاستجابات من 18 نموذجاً ريادياً وتواجه المصنفات الحالية صعوبة في اكتشاف هذه الأضرار.

Naymul Islam, Nusrat Jahan Lia, Shubhashis Roy Dipta, Sabik Bin Sultan, Abdullah Khan Zehady2026-08-25
🤖 AI

TransHands: Repurposing Human Pose Encoders as Hand Pose Encoders

تقدم الورقة البحثية TransHands، وهو إطار عمل لنقل التعلم غير مرتبط بهيكل محدد (backbone-agnostic) يعيد توظيف مشفرات حركة جسم الإنسان مسبقة التدريب لتقدير وضعيات اليد ثلاثية الأبعاد بفعالية من مدخلات ثنائية الأبعاد، مما يتغلب على ندرة مجموعات البيانات الضخمة ثلاثية الأبعاد لليد ويثبت تحقيق مكاسب أداء متسقة عبر بنيات متنوعة وسيناريوهات تصوير ذاتي (egocentric) صعبة.

Milo Piccioli, Gianluca Amprimo, Claudia Ferraris, Gabriella Olmo2026-08-25