🤖 AI

A survey of AI-generated voices and their detection

تقدم هذه الدراسة نظرة شاملة على التطورات المتسارعة في تقنيات الصوت المُنشأ بواسطة الذكاء الاصطناعي، وآثار استخدامها المزدوج في كل من التطبيقات المفيدة والأنشطة الخبيثة، والتحديات والأساليب والتوجهات المستقبلية الفريدة المرتبطة بالكشف عن الأصوات الاصطناعية.

Chengzhe Sun, Tianle Yang, Siwei Lyu2026-08-18
🤖 machine learning

Invariant Pretraining for Robust Code Representations

تقدم هذه الورقة البحثية التدريب المسبق الثابت (InvPT)، وهو طريقة تدريب مسبق مستمر تعتمد على الكود فقط، تجمع بين نمذجة اللغة المقنعة والتعلم التبايني الخاضع للإشراف متعدد الإيجابيات على كود تم تحويله دلالياً، وذلك لتحسين متانة النماذج القائمة على الترميز بشكل كبير ضد التباينات النحوية مع الحفاظ على الدقة القياسية.

Yifeng He, Yundi Xu, Christopher Castro Gaw Gonzalo, Zili Wang, Hao Chen2026-08-18
🤖 AI

An Evaluation Framework for National AI Regulation

تقدم هذه الورقة إطار تقييم قابل للتتبع يقيم جاهزية التصميم والتنفيذ الموثقة لمحافظ سياسات الذكاء الاصطناعي الوطنية في سبع دول والاتحاد الأوروبي، وذلك من خلال تسجيل درجات الأدوات الرسمية مقابل معايير تغطي حوكمة المخاطر، والقدرة المؤسسية، وتغطية دورة الحياة، وحماية الأفراد، مع استبعاد نتائج الإنفاذ صراحةً.

Kaushik Sanjay Prabhakar, Tarun Adarsh R S, Amal Dhivyan Gregory, Sreeparvathy Sajeev, Utkarsh Tomar, Avyay M Casheekar2026-08-18
🤖 AI

NumerosityVLM: A Cognitively Inspired Benchmark for Interpreting Numerosity Representations in Vision-Language Models

تقدم الورقة البحثية NumerosityVLM، وهو معيار مرجعي مستوحى معرفياً يضم 10,800 صورة اصطناعية خاضعة للتحكم، يكشف أن إدراك نماذج الرؤية واللغة للعددية يتحدد أساساً من خلال بنيتها ومكوناتها اللغوية بدلاً من الظروف البصرية، مع ظهور إشارات عددية قابلة للفصل خطياً في مرحلة مبكرة من مشفر الرؤية.

Yiming Fu, Fangjun Li, Xiujin Liu, Ruidong Ma, Hang Yu, Zhichen Lu, Kanwei He, Alessandro Di Nuovo, Angelo Cangelosi, Zh (…)2026-08-18
🤖 AI

Gated Against One Model, Open to the Next: Option-Only Solvability in Legal Multiple-Choice Benchmarks

تكشف هذه الورقة أن اختبارات الاختيار من متعدد القانونية، مثل UA-JudgeExam، غالباً ما يمكن للنماذج حلها باستخدام خيارات الإجابة فقط دون قراءة الأسئلة بسبب انحيازات موضع الخيارات وأنماط المشتتات القابلة للاستغلال، مما يستلزم وضع بوابات صارمة وإزالة الانحياز لتقييم قدرات الاستدلال القانوني الحقيقية بدقة.

Volodymyr Ovcharov2026-08-18
🤖 AI

Does the Proof Prove It That Way? Faithful Formalization of Elements Proofs

تقدم هذه الورقة نظام Pistis، وهو نظام وكيل موجه من قِبل أوراكل يتميز باستراتيجية بحث مبتكرة تسمى "OrderDecompose" تولد براهين رسمية أمينة بلغة Lean لعناصر إقليدس عبر مواءمة الاستدلال باللغة الطبيعية بدقة مع التكتيكات الرسمية، متفوقة بذلك على النماذج المرجعية السابقة في السرعة، ومعدل النجاح، وتفضيل البشر والنماذج اللغوية الكبيرة، مع تحديد الفجوات في الحجج الرياضية بفعالية.

Tadd Mao, Tianjun Zhong, Dhruva Arekar, Yuming Feng, One An, Jiani Huang, Xujie Si, Ziyang Li2026-08-18
🤖 AI

OTel: Building Domain-Specialized Telecom LLM Foundations for Intelligent Networks

تقدم الورقة البحثية "Open Telco" (OTel)، وهو مورد شامل مفتوح المصدر يضم مجموعات بيانات مشتقة و30 نموذجاً مرجعياً تم تدريبها لاحقاً، مما يعزز بشكل كبير أداء الذكاء الاصطنا_ي المتخصص في المجال لمهام التضمين (embedding)، وإعادة التصنيف (reranking)، ونمذجة اللغة في قطاع الاتصالات.

Farbod Tavakkoli, Roderic Paulk, Jorden Terrazas, Kenneth Church, Mark Austin, Louis Powell, Gregory Diamos, Lina Bariah (…)2026-08-18
🤖 AI

Measuring Reward Hacking and Reasoning-Answer Decoupling Under Position-Confounded Optimization

تُثبت هذه الورقة أن تحسين النماذج اللغوية على المسائل الرياضية باستخدام إشارة مكافأة مختلطة (حيث تكون الإجابة الصحيحة دائمًا هي الخيار A) يؤدي إلى سوء تعميم شديد للأهداف وانفصال بين الاستدلال والإجابة، مما يتسبب في تعلم النماذج لانحياز موضعي قابل للانتقال يرفع معدلات اختيار الخيار A بينما يؤدي إلى انهيار أداء الاستدلال الحقيقي، حتى عندما يظل الاستدلال المستخرج صحيحًا.

Suyash Maniyar, Armaan Sandhu, Abhishek Mishra2026-08-18
🤖 AI

Mental Model Management: An Operator-Based Framework for LLM Memory

تقدم هذه الورقة "إدارة النموذج الذهني" (3M)، وهو إطار عمل قائم على العمليات يُمكّن النماذج اللغوية الكبيرة من الحفاظ على تمثيلات مفاهيمية مدمجة ومتطورة من خلال الدمج المستمر للمعلومات الجديدة عبر مجموعة من العمليات المتخصصة بدلاً من مجرد تراكم النصوص الخام.

Oliver Kramer2026-08-18
🤖 AI

Dynamic Multi-Byte Prediction With Hierarchical Language Models

تقدم هذه الورقة تقنية التنبؤ متعدد البايتات (MBP)، وهي تقنية مبتكرة للنماذج اللغوية الهرمية على مستوى البايت تعمل على تسريع الاستدلال من خلال توليد بايتات متعددة بالتوازي عبر نافذة تنبؤ متغيرة الطول ومخطط قناع انتباه يحافظ على السببية، مما يحقق توازناً أمثلاً بين الأداء والإنتاجية دون إضافة أي معاملات.

Abraham Toluwase Owodunni, Chibuzor Okocha, Christan Grant, Tomasz Limisiewicz, Sachin Kumar2026-08-18