🤖 AI

There Is No Neutral Harness: Modern LLM Leaderboards Are Manufactured by Config-Fragile Items

تُثبت هذه الورقة أن لوحات صدارة النماذج اللغوية الكبيرة الحديثة غير موثوقة بشكل أساسي لأن إعدادات أدوات التقييم (مثل صياغة المطالبات وطرق تسجيل النقاط) هي المحركات الرئيسية لتباين الأداء، وغالباً ما تحدد ترتيب النماذج أكثر من قدراتها الفعلية.

V. S. Raghu Parupudi2026-08-25
💻 computer science

Determinants of Starting Salaries for Filipino Graduates: An Explainable Machine Learning Approach

تستخدم هذه الدراسة نهج تعلم آلي قابل للتفسير على بيانات استطلاع تم جمعها من الجمهور لتوضيح أن الدور الوظيفي والقطاع هما المحددان الرئيسيان لرواتب البداية للخريجين الفلبينيين، مما يتجاوز بشكل كبير مكانة المؤسسة التعليمية، ويشير إلى الحاجة إلى إعطاء الأولوية للمهارات النوعية المرتبطة بالقطاعات في التوجيه المهني والسياسات.

Alexander Gabriel A. Aranes, John Michael C. Magpantay, Reginald Neil C. Recario, Jamlech Iram N. Gojo Cruz, Rodolfo C. (…)2026-08-25
💬 NLP

Beyond Two Bytes per Letter: Tokenization Overhead in Cyrillic AI Systems

تُحدد هذه الورقة البحثية كمياً العبء الإضافي الكبير في عملية التجزئة (tokenization) الذي تواجهه اللغة الأوكرانية وغيرها من اللغات السيريلية في أنظمة الذكاء الاصطناعي الحديثة مقارنة باللغة الإنجليزية، موضحةً أن هذا التفاوت ينبع من تخصيص بيانات التدريب، ولكن يمكن التخفيف من حدته بفعالية من خلال تقنيات الضغط أثناء الاستنتاج أو عبر تدريب أجهزة تجزئة "BPE" متوازنة على مستوى البايت.

Ivan Dobrovolskyi2026-08-25
🤖 machine learning

Model of Models: When Does Emitting a Specialist Beat Attending, Adapting, or Tuning?

تقارن هذه الورقة بشكل منهجي بين أربع آليات لتخصص النماذج عبر مهام متنوعة، مظهرةً أن إصدار أوزان متخصصة عبر شبكة فائقة (hypernetwork) يقدم بديلاً فعالاً من حيث التكلفة للتكيف في وقت الاختبار وللانتباه داخل السياق (in-context attention) للمشكلات ذات الأبعاد المنخفضة أو المهيكلة، بينما يكشف في الوقت نفسه عن حدود سعة متأصلة تمنعه من مضاهاة التعلم داخل السياق في نمذجة التسلسلات عالية الأبعاد.

John C. Howell2026-08-25
💻 computer science

Interrupting the Chain: Human Perception of AI-Generated Disinformation Through a Kill Chain Lens

تقدم هذه الورقة نتائج تجريبية من دراسة أجريت على بشر تُظهر أنه في حين تولد النماذج اللغوية الكبيرة الحديثة معلومات مضللة لا يمكن تمييزها عن المحتوى البشري، وأن زيادة الشك لا تنجح في تحسين دقة الكشف، فإن التعرض المستمر يتسبب في انخفاض غير متماثل كبير في القدرة على كشف الأخبار الزائفة، مما يحدد نقاط تدخل معرفي محددة ضمن إطار عمل سلسلة قتل الأمن السيبراني للدفاع الاستباقي.

Alexander Loth, Martin Kappes, Marc-Oliver Pahl2026-08-25
💻 computer science

ODG-NoMaD: Overhead-Camera Direction-Guided NoMaD

يعمل ODG-NoMaD على تعزيز سياسة الملاحة الرؤيوية NoMaD من خلال دمج التوجيه العالمي المستمد من الكاميرا العلوية في عملية الاستكشاف القائمة على الانتشار، مما يقلل بشكل كبير من المسافة إلى الهدف ويضمن ملاحة خالية من الاصطدامات في بيئات غير مرئية دون الحاجة إلى إعادة تدريب السياسة.

Blossom Treesa Bastian, Keerthi S. Shetty, Manish Kolachalam, Rani Malhotra, Ashish Dutta2026-08-25
💻 computer science

Mamba-based Selective State Space Modeling Improves the Accuracy-Complexity Tradeoff of SmolVLA Vision-Language-Action Experts

تُثبت هذه الورقة أن دمج نمذجة الحالة الانتقائية القائمة على Mamba في خبير الأفعال SmolVLA يحسن بشكل كبير من مقايضة الدقة والتعقيد لنماذج الرؤية واللغة والأفعال، محققاً معدلات نجاح متفوقة على نماذج Transformer أثناء التنفيذ طويل المدى مع تقليل تعقيد المعلمات بنسبة 24% تحت إعادة التخطيط لكل فعل.

Farida Mohsen, Thowayba Elkaffash, Mohammad Reza Chalak Qazani, Mohamed Mabrok, Nader Meskin, Ali Safa2026-08-25
🤖 AI

Hate Speech Classification In Roman Urdu: A Comparative Study On Parameter Efficient Fine-Tuning And Prompt Engineering

تقارن هذه الدراسة بين فعالية الاستدلال بضبط الصفر، والضبط الدقيق كفء المعلمات (LoRA)، وضبط المطالبة، وهندسة المطالبة لتصنيف خطاب الكراهية في السياق منخفض الموارد وغير الرسمي للغة الأردية المكتوبة بالأحرف اللاتينية (Roman Urdu).

Toneema Zubair2026-08-25
🤖 AI

The Abstention Protocol: RCA for Clos Fabrics

تقدم هذه الورقة نظام CoreSec، وهو نظام إنتاجي لتحليل الأسباب الجذرية لشبكات Clos واسعة النطاق، يستبدل دمج النقاط غير المستقر بجبر امتناع من نمط PAM حتمي لتحقيق عزو للأعطال يتسم بالاستقرار والقابلية للتفسير والرتابة في بيئات القياس عن بُعد الصاخبة.

Madhava Gaikwad, Deepak Pandey2026-08-25
💬 NLP

Mitigating Bias in Large Vision-Language Models via Counterfactual Ensemble Decoding

تقترح هذه الورقة "فك التشفير بالتعليق التوضيحي للمجموعات المتعددة عبر التناقض الشرطي" (CED)، وهو إطار عمل مبتكر يعمل على تخفيف التحيزات الاجتماعية في النماذج اللغوية البصرية الكبيرة من خلال بناء وتجميع منظورات تناقض شرطي متعددة المجموعات داخل فضاء التمثيل البصري لتعزيز التوليد العادل مع الحفاظ على القدرات الجوهرية للنموذج.

Yisong Xiao, Aishan Liu, Yongxin Huang, Zonghao Ying, Shiji Zhao, Tianlin Li, Yong Han, Jian Yang, Xianglong Liu2026-08-25