💬 NLP

Fine-Grained Table Retrieval Through the Lens of Complex Queries

تقدم هذه الورقة البحثية DCTR، وهي آلية لاسترجاع الجداول تستفيد من تفكيك الاستعلام المعتمد على الأنواع دقيق التفاصيل والوعي بالاتصال العالمي للتعامل بفعالية مع الإجابة على الأسئلة المعقدة في النطاق المفتوح عبر قواعد البيانات العلاقاتية، مما يظهر متانة على المعايسات المرجعية المتوافقة مع الصناعة.

Wojciech Kosiuk, Xingyu Ji, Yeounoh Chung, Fatma Özcan, Madelon Hulsebos2026-03-10
💬 NLP

Scaling Self-Supervised Speech Models Uncovers Deep Linguistic Relationships: Evidence from the Pacific Cluster

تُظهر هذه الورقة أن توسيع نطاق نماذج الكلام ذاتية الإشراف من 1,000 إلى 4,000 لغة يؤدي إلى تحول غير خطي يُمكّن من اكتشاف العلاقات النسبية العميقة وأنماط الاتصال المعقدة، وهو ما يتجلى في ظهور عنقود كلي متين لمنطقة المحيط الهادئ مدفوعاً بالسمات الصوتية المشتركة.

Minu Kim, Hoirin Kim, David R. Mortensen2026-03-10
💬 NLP

Taiwan Safety Benchmark and Breeze Guard: Toward Trustworthy AI for Taiwanese Mandarin

تقدم هذه الورقة TS-Bench، وهو معيار قياسي لتقييم السلامة في لغة الماندرين التايوانية، وBreeze Guard، وهو نموذج سلامة بحجم 8 مليارات معلمة تم ضبطه بدقة باستخدام بيانات قائمة على أسس ثقافية، والذي يتفوق بشكل كبير على نماذج السلامة العامة في المخاطر المرتبطة بمنطقة محددة، بينما يثبت أن الكشف الفعال عن السلامة يتطلب وجود أساس ثقافي مسبق في النموذج الأساسي.

Po-Chun Hsu, Meng-Hsi Chen, Tsu Ling Chao, Chia Tien Han, Da-shan Shiu2026-03-10
💬 NLP

RILEC: Detection and Generation of L1 Russian Interference Errors in English Learner Texts

تقدم هذه الورقة RILEC، وهي مجموعة بيانات واسعة النطاق وإطار عمل توليدي للكشف عن أخطاء التداخل من اللغة الروسية (L1) وإنشائها في نصوص متعلمي اللغة الإنجليزية، مما يثبت أن النماذج التي تم ضبطها بدقة باستخدام هذه البيانات المعززة تحسن بشكل كبير من تحديد أنواع أخطاء محددة مثل الترجمة الحرفية وسوء استخدام الزمن.

Darya Kharlamova, Irina Proskurina2026-03-10
💬 NLP

Can Large Language Models Keep Up? Benchmarking Online Adaptation to Continual Knowledge Streams

تقدم هذه الورقة البحثية OAKS، وهو معيار مصمم لتقييم قدرة النماذج اللغوية الكبيرة على التكيف مع تدفقات المعرفة المتطورة باستمرار، كاشفةً أن النماذج الحالية المتطورة وأنظمة الذاكرة الوكيلية تعاني من صعوبة في تتبع الحالة بدقة وهي عرضة بشدة للتشتت في البيئات الديناميكية.

Jiyeon Kim, Hyunji Lee, Dylan Zhou, Sue Hyun Park, Seunghyun Yoon, Trung Bui, Franck Dernoncourt, Sungmin Cha, Minjoon S (…)2026-03-10
💬 NLP

Cross-Modal Taxonomic Generalization in (Vision-) Language Models

تُثبت هذه الورقة أن نماذج الرؤية واللغة يمكنها استعادة وتعميم المعرفة التصنيفية (الأسماء العليا) من التمثيلات اللغوية حتى عند حرمانها من الأدلة البصرية الصريحة أثناء التدريب، شريطة أن تحافظ خرائط الربط بين الصور والملصقات الافتراضية على تماسك بصري عالٍ ضمن الفئات.

Tianyang Xu, Marcelo Sandoval-Castaneda, Karen Livescu, Greg Shakhnarovich, Kanishka Misra2026-03-10
💬 NLP

Skip to the Good Part: Representation Structure & Inference-Time Layer Skipping in Diffusion vs. Autoregressive LLMs

تكشف هذه الورقة أن نماذج اللغة الانتشارية تطور تمثيلات داخلية هرمية متميزة مع وجود تكرار في الطبقات المبكرة مقارنة بالنماذج ذات التوليد الذاتي، مما يتيح طريقة استدلال مبتكرة لتخطي الطبقات دون الحاجة للتدريب تقلل التكاليف الحسابية بشكل كبير مع الحفاظ على أداء عالٍ.

Raghavv Goel, Risheek Garrepalli, Sudhanshu Agrawal, Chris Lott, Mingu Lee, Fatih Porikli2026-03-10
💬 NLP

A Joint Neural Baseline for Concept, Assertion, and Relation Extraction from Clinical Text

تقترح هذه الورقة نظاماً عصبياً مشتركاً جديداً من طرف إلى طرف يعمل على تحسين التعرف على المفاهيم، وتصنيف التأكيد، واستخراج العلاقات للنصوص السريرية في آن واحد، متفوقاً بشكل كبير على النماذج التقليدية المتسلسلة في جميع المهام الثلاث.

Fei Cheng, Ribeka Tanaka, Sadao Kurohashi2026-03-10
💬 NLP

Bolbosh: Script-Aware Flow Matching for Kashmiri Text-to-Speech

تقدم هذه الورقة Bolbosh، وهو أول نظام عصبي مفتوح المصدر لتحويل النص إلى كلام للغة الكشميرية، والذي يستخدم استراتيجية تكييف عبر لغوية خاضعة للإشراف ومعتمدة على النص، بناءً على مطابقة التدفق الشرطي للنقل الأمثل ومسار تعزيز صوتي ثلاثي المراحل للتغلب على قيود النماذج المرجعية متعددة اللغات ذات القدرة على التوليد من محاولة واحدة (zero-shot)، وتحقيق جودة كلام ووضوح أعلى بشكل ملحوظ.

Tajamul Ashraf, Burhaan Rasheed Zargar, Saeed Abdul Muizz, Ifrah Mushtaq, Nazima Mehdi, Iqra Altaf Gillani, Aadil Amin K (…)2026-03-10
🤖 machine learning

Scalable Training of Mixture-of-Experts Models with Megatron Core

تقدم هذه الورقة Megatron Core، وهو إطار عمل مفتوح المصدر وقابل للتوسع وجاهز للإنتاج، يعالج تحديات الذاكرة والاتصال والحوسبة المترابطة لتدريب نماذج خليط الخبراء (MoE) من خلال تحسينات متكاملة على مستوى النظام، مما يتيح تدريباً عالي الأداء لنماذج تتراوح أحجامها من المليارات إلى التريليونات من المعلمات على مجموعات ضخمة من وحدات معالجة الرسومات (GPU).

Zijie Yan (NVIDIA), Hongxiao Bai (NVIDIA), Xin Yao (NVIDIA), Dennis Liu (NVIDIA), Tong Liu (NVIDIA), Hongbin Liu (NVIDIA (…)2026-03-10