💬 NLP

Scaling Probabilistic Transformer via Efficient Cross-Scale Hyperparameter Transfer

تقدم هذه الورقة طريقة فعالة لنقل المعلمات الفائقة عبر المقاييس بناءً على معلمات التحديث الأقصى (muP)، والتي تُمكّن المحول الاحتمالي (Probabilistic Transformer) من التوسع حتى 0.4 مليار معلمة مع التفوق باستمرار على المحولات القياسية في مهام نمذجة اللغة المقنعة تحت نفس ميزانية المعلمات.

Penghao Kuang, Haoyi Wu, Kewei Tu2026-04-29
⚡ electrical engineering

Praxy Voice: Voice-Prompt Recovery + BUPS for Commercial-Class Indic TTS from a Frozen Non-Indic Base at Zero Commercial-Training-Data Cost

تحقق Praxy Voice أداءً في تحويل النص إلى كلام بمستوى تجاري للغات التيلجو والتاميل والهندية من خلال الجمع بين فضاء فونيم موحد لغات البرهمية (BUPS) لتحويل النصوص، ومحول LoRA نصي فقط تم تدريبه على بيانات مرخصة، ووصفة أخذ عينات محددة لتلقين الصوت، وكل ذلك دون الحاجة إلى بيانات تدريب تجارية أو إعادة تدريب لفك التشفير الصوتي.

Venkata Pushpak Teja Menta2026-04-29
💬 NLP

Navigating Global AI Regulation: A Multi-Jurisdictional Retrieval-Augmented Generation System

تقدم هذه الورقة نظاماً للتوليد المعزز بالاسترجاع متعدد الولايات القضائية يتنقل عبر اللوائح العالمية المعقدة للذكاء الاصطناعي من خلال توظيف تقنيات متخصصة مثل التجزئة النوعية وتوجيه الاسترجاع الشرطي لتحقيق دقة عالية في الإجابة على الاستفسارات القانونية الفردية ومتعددة الولايات القضائية.

Courtney Ford, Ojas Rane, Susan Leavy2026-04-29
💬 NLP

Benchmarking Logistic Regression, SVM, and LightGBM Against BiLSTM with Attention for Sentiment Analysis on Indonesian Product Reviews

تقارن هذه الورقة البحثية بين خوارزميات تعلم الآلة التقليدية (الانحدار اللوجستي، وآلات ناقلات الدعم، وLightGBM) ونموذج BiLSTM مع آلية الانتباه لتحليل المشاعر في اللغة الإندونيسية، حيث وجدت أن أفضل نموذج تعلم آلة أداءً (الانحدار اللوجستي) يتفوق قليلاً على نهج التعلم العميق مع توفير كفاءة حوسبية أكبر.

Razin Hafid Hamdi, Ivana Margareth Hutabarat, Hanna Gresia Sinaga, Luluk Muthoharoh, Ardika Satria, Martin C. T. Manulla (…)2026-04-29
💬 NLP

An Investigation of Linguistic Biases in LLM-Based Recommendations

تتقصى هذه الدراسة التحيزات اللغوية في توصيات المطاعم والمنتجات القائمة على النماذج اللغوية الكبيرة عبر لهجات جنوب أمريكا، والإنجليزية الهندية، واللغة الهجينة (Code-Switched) بين الهندية والإنجليزية، كاشفةً أن عائلات نماذج محددة تُظهر حساسية متزايدة تجاه مطالبات الإنجليزية الهندية واللغة الهجينة، مما يؤدي إلى تباينات متميزة في أنماط التوصية دون وجود اتجاهات ثابتة تعتمد فقط على حجم النموذج.

Nitin Venkateswaran, Jason Ang, Deep Adhikari, Tarun Krishna Dasari2026-04-29
💬 NLP

PSP: An Interpretable Per-Dimension Accent Benchmark for Indic Text-to-Speech

تقدم هذه الورقة البحثية ملف استبدال الفونيمات (PSP)، وهو معيار مرجعي قابل للتفسير لكل بُعد، يقيم أنظمة تحويل النص إلى كلام للغات الهندية بناءً على سمات لهجوية محددة مثل الارتداد (retroflexion) والهمس (aspiration)، مما يكشف أن الأنظمة التجارية والمفتوحة المصدر الرائدة حالياً غالباً ما تخفق في التقاط هذه الفروق الفونولوجية الدقيقة رغم تسجيلها درجات عالية في معايير الوضوح القياسية.

Venkata Pushpak Teja Menta2026-04-29
💬 NLP

From Chatbots to Confidants: A Cross-Cultural Study of LLM Adoption for Emotional Support

تقدم هذه الدراسة أول تحليل عابر للثقافات واسع النطاق لتبني نماذج اللغات الكبيرة (LLMs) للدعم العاطفي عبر سبع دول، كاشفةً عن تباينات كبيرة في معدلات الاستخدام والتصورات مدفوعة بالعوامل الديموغرافية والسياق الثقافي، مع تسليط الضوء على الاحتياجات العاطفية المتنوعة التي يسعى المستخدمون لتلبيتها من خلال هذه الأنظمة.

Natalia Amat-Lefort, Mert Yazan, Amanda Cercas Curry, Flor Miriam Plaza-del-Arco2026-04-29
💬 NLP

Marco-MoE: Open Multilingual Mixture-of-Expert Language Models with Efficient Upcycling

تُعدّ Marco-MoE مجموعة نماذج "خليط الخبراء" (Mixture-of-Experts) متعددة اللغات، مفتوحة بالكامل وعالية التناثر، والتي تستفيد من عملية إعادة التدوء الفعالة (upcycling) لتحقيق أفضل نسب الأداء إلى الحوسبة وتدرج فائق عبر اللغات مقارنة بالمنافسين الأكثر كثافة.

Fan Jiang, Yu Zhao, Chenyang Lyu, Tianqi Shi, Yichao Du, Feihu Jiang, Longyue Wang, Weihua Luo2026-04-29
💬 NLP

Bye Bye Perspective API: Lessons for Measurement Infrastructure in NLP, CSS and LLM Evaluation

تنتقد هذه الورقة التبعية الهيكلية لأبحاث معالجة اللغات الطبيعية والنماذج اللغوية الكبيرة لواجهة برمجة تطبيقات "بيرسبكتيف" (Perspective API) المملوكة التي ستتوقف عن العمل الآن، مسلطة الض الضوء على كيفية تسبب تحديثاتها الغامضة وتوصيفها الأحادي للسمية في خلق نتائج غير قابلة لإعادة الإنتاج، وتدعو إلى إنشاء بنية تحتية مستقلة وصالحة وقابلة لإعادة الإنتاج للقياس من أجل منع مخاطر معرفية مماثلة في المستقبل.

David Hartmann, Manuel Tonneau, Angelie Kraft, LK Seiling, Dimitri Staufer, Pieter Delobelle, Jan Fillies, Anna Ricarda (…)2026-04-29
💬 NLP

The Surprising Universality of LLM Outputs: A Real-Time Verification Primitive

تقدم هذه الورقة بحثاً حول أداة تقييم أولية فائقة السرعة وتعمل على المعالج المركزي فقط، تستفيد من توزيع ماندلبروت العالمي للرتب والتردد المكون من معلمين لنمذجة مخرجات النماذج اللغوية الكبيرة، وذلك لتمكين البصمة الإحصائية للنماذج وتقييم المخرجات في الصندوق الأسود بتأخير يصل إلى 100,000 مرة أقل من أدوات الكشف الحالية القائمة على أخذ العينات.

Alex Bogdan, Adrian de Valois-Franklin2026-04-29