💬 NLP

Self-Guided Process Reward Optimization with Redefined Step-wise Advantage for Process Reinforcement Learning

تقدم هذه الورقة البحثية SPRO، وهو إطار عمل ذاتي التوجيه لتعلم التعزيز العملياتي يلغي الحاجة إلى نماذج مكافآت خارجية من خلال اشتقاق مكافآت عملياتية جوهرية وإعادة تعريف تقدير الميزة خطوة بخطوة، مما يحقق كفاءة ودقة واستقراراً فائقاً في التدريب دون أعباء حسابية إضافية مقارنة بالطرق القياسية الخاضعة للإشراف على النتائج.

Wu Fei, Shuxian Liang, Yibo Yang, Yang Lin, Jing Tang, Lei Chen, Xiansheng Hua, Hao Kong2026-07-27
🤖 AI

Generative Artificial Intelligence in Bioinformatics: A Systematic Review of Models, Applications, and Methodological Advances

تقيم هذه المراجعة المنهجية التأثير التحولي للذكاء الاصطناوي التوليدي على المعلوماتية الحيوية، مع تسليط الضوء على أدائه المتفوق في التطبيقات المتخصصة مثل علم الجينوم واكتشاف الأدوية، بينما تحدد التحديات الرئيسية مثل تحيز البيانات وقابلية التوسع.

Wasimul Karim, Riasad Alvi, Sayeem Been Zaman, Arefin Ittesafun Abian, Mohaimenul Azam Khan Raiaan, Saddam Mukta, Md Raf (…)2026-07-27
💬 NLP

Gemma 4 Technical Report

تقدم الورقة البحثية Gemma 4، وهي جيل جديد من النماذج اللغوية مفتوحة الأوزان ومتعددة الوسائط أصلاً، والتي تتميز ببنيات متنوعة، وتصميم موحد خالٍ من المشفر (encoder-free)، ونمط تفكير، مما يحقق مجتمعاً تحسينات كبيرة في الاستنتاج والكفاءة والأداء عبر معايير العلوم والتكنولوجيا والهندسة والرياضيات (STEM) والسياقات الطويلة.

Gemma Team, Sherif El Abd, Vaibhav Aggarwal, Robin Algayres, Alek Andreev, Olivier Bachem, Ian Ballantyne, Cormac Brick (…)2026-07-27
💬 NLP

DFAH-Bench: Benchmarking Observable Agent Instability in Financial Decision-Making

يقدم DFAH-Bench إطار عمل جديد للتقييم المرجعي لا يكتفي بتقييم وكلاء الذكاء الاصطناعي المالي بناءً على صحة القرار فحسب، بل يقيس أيضاً استقرار وأمانة مسارات تنفيذهم المرصودة، مما يكشف عن تضاربات كبيرة في استخدام الأدوات ومسارات الاستدلال حتى عندما تظل القرارات النهائية متسقة.

Raffi Khatchadourian2026-07-27
💬 NLP

GaugeQuant: Online Learning of Quantization-Optimal Bases from LLM Symmetries

تُعد GaugeQuant طريقة تعلم عبر الإنترنت تستفيد من تناظرات النماذج اللغوية الكبيرة (LLM) ومن حد خسارة (LogSumExp) لتعلم القواعد المثلى للكمّ ديناميكيًا أثناء التدريب، مما يقلل بشكل كبير من الحيرة (perplexity) تحت الكمّ منخفض البتات دون الحاجة إلى بيانات معايرة أو تغيير هدف النمذجة اللغوية.

Miguel P. Bento, João F. Seabra2026-07-27
💬 NLP

Agentic coding without the cloud: evaluating open-weight large language models on longitudinal data preparation tasks

تقدم هذه الورقة إطار عمل مفتوح المصدر يثبت أن نماذج اللغات الكبيرة ذات الأوزان المفتوحة والقابلة للنشر محلياً (تحديداً النماذج التي تتراوح بارامتراتها بين 31 و35 مليار بارامتر) يمكنها أتمتة مهام إعداد البيانات الطولية بفعالية على أجهزة استهلاكية، مما يوفر بديلاً قابلاً للتطبيق ومتوافقاً مع معايير الحوكمة للذكاء الاصطناذ القائم على السحابة في الأبحاث التي تتضمن بيانات شخصية حساسة.

Mack Nixon, Liam Wright, Yevgeniya Kovalchuk, Alison Fang-Wei Wu, Martin Danka, Andy Boyd, David Bann2026-07-27
🤖 AI

The Hard Decision Layer: Evidence for Committed Inference in Transformers

تحدد هذه الورقة وتتحقق من صحة "طبقة القرار الحازم" (HDL)، وهي خاصية بنيوية طبيعية في نماذج المحولات (transformer) حيث تستقر ترتيبات الإجابات بشكل مفاجئ أثناء الاستدلال، مما يؤدي إلى تحسينات كبيرة في الدقة ويقدم رؤى جديدة للاستدلال الفعال وتوجيه النماذج.

Ashwath Vaithinathan Aravindan, Mayank Kejriwal2026-07-27
🤖 AI

Do VLMs Read or Rewrite? On Transcription Faithfulness in Vision-Language Models

تقدم هذه الورقة معيار FaithC4 لتوضيح أن نماذج الرؤية واللغة غالباً ما تعيد كتابة النصوص غير المكتملة إلى أشكال تبدو منطقية بدلاً من نسخها بأمانة، مما يكشف عن أنماط تدهور متميزة عبر أنواع النماذج ويحدد تمثيلات طبقات وكلمات محددة تحفز سلوك إعادة الكتابة هذا.

Gwang Gook Lee, Kenan Emir Ak, Jay Mohta, Yan Xu, Dimitrios Dimitriadis2026-07-27
💬 NLP

Adversarial Style Optimization: Enhancing VLM Jailbreaks by GRPO-based Stylistic Triggers Optimization

تقدم هذه الورقة البحثية "تحسين الأسلوب التنافسي" (ASO)، وهو إطار عمل قائم على خوارزمية (GRPO) يستغل عدم الاتساق الأسلوبي في النماذج اللغوية الكبيرة متعددة الوسائط لتعزيز معدلات نجاح هجمات كسر الحماية بشكل كبير من خلال تحسين المحفزات الأسلوبية البصرية مع الحفاظ على المحتوى الدلالي.

Bingjun Luo, Jialin Guo, Yue Yao, Xinpeng Ding2026-07-27
💬 NLP

A Consensus-Based Framework for Relative Preference Evaluation of Large Language Models

تقترح هذه الورقة إطار عمل قابلاً للتوسع وقائماً على الإجماع، يقوم بتقييم النماذج اللغوية الكبيرة من خلال تجميع تصنيفاتهم المتبادلة لاستجابات مجهولة المصدر لتوليد "مؤشر ذكاء نسبي"، مما يقدم بديلاً مدفوعاً بالنماذج للمقاييس الثابتة التقليدية لتقييم جودة الاستجابة في السيناريوهات التي توجد فيها إجابات متعددة صحيحة.

Mohtashim Khan2026-07-27