💬 NLP

Don't Repeat Yourself: Stopping Verbatim Loops at Sampling Time

تقدم الورقة البحثية تقنية "لا تكرر نفسك" (DRY)، وهي تعديل للوغاريتمات (logits) عند وقت أخذ العينات يعمل على تقليل التكرار الحرفي في النماذج اللغوية الكبيرة بفعالية عبر معاقبة الرموز (tokens) التي تمدد تطابقات لاحقة دقيقة من السياق السابق، مما يحسن التنوع المعجمي والطلاقة دون تدهور في الأداء أو الحاجة إلى إعادة تدريب النموذج.

Philipp Emanuel Weidmann, Allen Roush, Judah Goldfeder, Sanjay Basu, Ravid Shwartz-Ziv2026-08-25
🤖 AI

The Retriever Should Remember: Experience-Amortized Reranking for Long-Term Agent Memory

تقدم هذه الورقة البحثية إطار عمل EARM، وهو إطار لإعادة الترتيب القائم على استهلاك الخبرة (experience-amortized)، والذي يتعلم كيفية إعادة استخدام درجات الصلة المكتسبة مسبقاً من النماذج اللغوية الكبيرة عبر إكمال المصفوفة السببي (causal matrix completion) لتحسين دقة استرجاع الذاكرة طويلة المدى للوكلاء بشكل كبير مع تقليل عبء الاستدلال بشكل جوهري.

Qi Feng, Chris Ding, Jicong Fan2026-08-25
🤖 AI

Performance of a domain-specific large language model in answering patient questions in psychiatry

على الرغم من تفوق النموذج اللغوي الكبير المتخصص في هذا المجال "MIND" على روبوتات الدردشة العامة في درجات المعايير الموضوعية والاكتمال، إلا أن الأطباء النفسيين المرخصين فضلوا في نهاية المطوير الاستجابات التي أنشأها ChatGPT رغم ما يتمتع به "MIND" من تدريب متفوق على الدقة السريرية.

Alexander J. Hish, Arjun Nagendran, Scott N. Compton2026-08-25
🤖 machine learning

Fairness-Aware Mixture-of-Experts via Subgroup Reweighting and Gate Regularization

تقترح هذه الورقة إطار عمل "خليط من الخبراء" (Mixture-of-Experts) متكاملًا وواعيًا بالعدالة، يعمل على التخفيف من حدة التحيز الناجم عن التوجيه وتفاوت الأداء عبر المجموعات الديموغرافية من خلال الجمع بين إعادة وزن المجموعات الفرعية وتنظيم إنتروبيا البوابة لضمان الاستخدام المتوازن للخبراء مع الحفاظ على أداء تنبؤي تنافسي.

Sunhee Hwang2026-08-25
🤖 AI

Let the Bullets Fly: Multimodal Fake News Detection with Temporal-Aligned Generative Danmaku

تقدم هذه الورقة Genda، وهو إطار توليدي زمني يحاكي تفاعلات الـ Danmaku في الوقت الفعلي للتغلب على مشكلات زمن الاستجابة، ويستفيد من التدفقات الزائفة الناتجة في نموذج DM-FEND مبتكر لتحقيق أفضل النتائج الحالية في الكشف عن الأخبار المزيفة متعددة الوسائط على كل من المعايير الصينية والإنجليزية.

Xiansheng Luo, Chaowei Zhang, Zewei Zhang, Yi Zhu, Jipeng Qiang2026-08-25
🤖 machine learning

Hierarchy-Aware Supervised Uncertainty Estimation for Black-box LLM Taxonomic Reasoning

تقترح هذه الورقة إطار عمل لتقدير عدم اليقين الخاضع للإشراف والمدرك للهيكلية الهرمية، والذي يستفيد من الميزات البديلة من النماذج اللغوية الكبيرة مفتوحة المصدر لتدريب مُقدِّرات خفيفة الوزن، مما يتفوق بشكل كبير على خطوط الأساس للاحتمالية الرمزية في التنبؤ بالصحة المرتبطة بالرتب ضمن الاستدلال التصنيفي للنماذج اللغوية الكبيرة "الصندوق الأسود" في مراقبة التنوع البيولوجي.

Shuting Xie, Nathaniel Lesperance, Graham W. Taylor2026-08-25
🤖 AI

FinixDoc: Rethinking Financial Document Parsing Beyond Saturated Benchmarks

يقدم FinixDoc نظام تحليل وكيل متكامل من البداية إلى النهاية يتميز بنموذج لغوي بصري بمقياس 4 مليار بارامتر تم تدريبه باستخدام التعلم التبايني المتخصص في المجال والتعلم المعزز، والذي يحقق أداءً هو الأفضل في فئته على مقياس FinixDocBench المقترح حديثاً من خلال المعالجة الفعالة للفجوة بين المعايير المرجعية المشبعة وتحديات المستندات المالية في العالم الحقيقي عبر مختلف الجودات البصرية والمقاييس.

Hang Wang, Jin Zhang, Guoliang Xu, Pengyue Lu, Yao Li, Zijiao Zhang, Tianyu Huang, Weiqi Xiong, Yulong Wang, Chuqiao Lu (…)2026-08-25
🤖 machine learning

The Mask Is Not the Model: Auditing Prefix Invariance in Attention, State-Space, and Hybrid Sequence Models

تقدم هذه الورقة طريقة تدقيق خفيفة الوزن، وخالية من التدريب، تكتشف انتهاكات ثبات البادئة (prefix invariance) في نماذج الانتباه، ونماذج فضاء الحالة، والنماذج الهجينة، وذلك عبر تحديد تسريبات السببية التي تفشل عمليات فحص أقنعة الانتباه القياسية في رصدها.

Taebong Kim, Youngsik Hong, Minsik Kim, Sunyoung Choi, Jaewon Jang, Minseo Kim2026-08-25
🤖 AI

Proxy reliance in large language model decisions is uncalibrated to predictive evidence

تكشف هذه الورقة أن النماذج اللغوية الكبيرة تُظهر اعتماداً غير معاير على السمات الوكيلة في اتخاذ القرار، حيث تفشل غالباً في مواءمة استخدامها للأدلة مع الحقيقة الجوهرية، وتُظهر أن التقييمات القياسية القائمة على الدقة وتغييرات الملصقات الديموغرافية البسيطة غير كافية للكشف عن هذه الانحيازات الدقيقة.

Zengqing Wu, Chuan Xiao2026-08-25
💬 NLP

AraDetox: A Multi-Dialect Arabic Detoxification Dataset

تقدم الورقة البحثية AraDetox، وهي مجموعة بيانات عربية متاحة للجمهور ومتعددة اللهجات تحتوي على 10,500 منشور ضار و84,000 إعادة صياغة غير ضارة (detoxified) تم إنشاؤها بواسطة النماذج اللغوية الكبيرة عبر العربية الفصحى، والخليجية، والشامية، والمصرية، والتي تُظهر أن إزالة السمية الفعالة تتضمن أساساً إعادة صياغة تحافظ على المعنى مع إزالة المحتوى الضار بنجاح.

Mo El-Haj2026-08-25