💬 NLP

A3 : an Analytical Low-Rank Approximation Framework for Attention

تقترح الورقة البحثية إطار العمل A³، وهو إطار تقريب منخفض الرتبة لما بعد التدريب يعمل تحليلياً على تقليص الأبعاد الخفية لمكونات المحولات (QK وOV وMLP) لتقليل الفقد الوظيفي، مما يحقق ضغطاً وأداءً فائقين مع عدم وجود أي عبء تشغيلي مقارنة بالطرق الحالية.

Jeffrey T. H. Wong, Cheng Zhang, Xinye Cao, Pedro Gimenes, Christos-Savvas Bouganis, George A. Constantinides, Wayne Luk (…)2026-05-14
💬 NLP

Revisit What You See: Revealing Visual Semantics in Vision Tokens to Guide LVLM Decoding

تقدم الورقة البحثية ReVisiT، وهي طريقة فك تشفير لا تتطلب تدريباً تعمل على التخفيف من الهلوسة في النماذج اللغوية البصرية الكبيرة عبر إسقاط الدلالات البصرية ذات الصلة ديناميكياً من الرموز البصرية في عملية توليد النصوص، محققةً أداءً متفوقاً مع تقليل التكلفة الحسابية.

Beomsik Cho, Jaehyung Kim2026-05-14
💬 NLP

Plan for Speed: Dilated Scheduling for Masked Diffusion Language Models

تقدم هذه الورقة "مجدول إزالة القناع بالتوسع" (DUS)، وهو أسلوب مخصص للاستدلال فقط يقوم بتقسيم مواضع التسلسل إلى مجموعات غير متجاورة لإزالة القناع بشكل متوازٍ لتقليل كسب الإنتروبيا المشتركة، مما يحقق تسريعًا في توليد النصوص يصل إلى 5.8 ضعفًا في نماذج اللغة ذات الانتشار المقنع دون المساس بالجودة أو تعديل المُنقي الأساسي.

Omer Luxembourg, Haim Permuter, Eliya Nachmani2026-05-14
💬 NLP

FLEXITOKENS: Flexible Tokenization for Evolving Language Models

تقدم الورقة البحثية FLEXITOKENS، وهي طريقة ترميز مرنة لنماذج اللغة على مستوى البايت تستخدم متنبئ حدود قابل للتعلم مع هدف تدريب مبسط للتغلب على جمود أجهزة الترميز الثابتة، مما يقلل من التجزئة المفرطة ويحقق تحسينات في الأداء تصل إلى 10% عبر لغات ومهام متنوعة.

Abraham Toluwase Owodunni, Orevaoghene Ahia, Sachin Kumar2026-05-14
💬 NLP

RDMA: Cost Effective Agent-Driven Rare Disease Mining from Electronic Health Records

تقدم الورقة البحثية وكلاء تنقيب الأمراض النادرة (RDMA)، وهو إطار عمل وكيل يستفيد من نماذج لغوية كبيرة أصغر حجماً ومكممة مع أدوات متخصصة لاستخراج معلومات الأمراض النادرة بدقة من السجلات الصحية الإلكترونية غير المهيكلة دون تدريب خاص بالمهمة، مما يحقق أداءً فائقاً وخفضاً كبيراً في التكاليف مقارنة بالنماذج المرجعية القائمة على الضبط الدقيق أو التوليد المعزز بالاسترداد (RAG)، مع تمكين النشر الخاص في الموقع.

John Wu, Adam Cross, Jimeng Sun2026-05-14
💬 NLP

CADDesigner: Conceptual CAD Model Generation with a General-Purpose Agent

يُعد CADDesigner عميلاً مدعوماً بالنماذج اللغوية الكبيرة، يستفيد من نموذج "البارادايم الأمرِي الصريح للسياق" (ECIP) المبتكر لتوليد نماذج تصميم بمساعدة الحاسوب (CAD) مفاهيمية عالية الجودة من النصوص والرسومات التخطيطية عبر الحوار التفاعلي، والتغذية الراجعة البصرية التكرارية، والتراكم المستمر للمعرفة.

Fengxiao Fan, Jingzhe Ni, Xiaolong Yin, Sirui Wang, Xingyu Lu, Qiang Zou, Ruofeng Tong, Min Tang, Peng Du2026-05-14
💬 NLP

Neural Machine Translation for Coptic-French: Strategies for Low-Resource Ancient Languages

تقدم هذه الورقة أول دراسة منهجية حول ترجمة اللغة القبطية إلى الفرنسية، مبرهنةً على أن الضبط الدقيق باستخدام مجموعة بيانات متنوعة أسلوبياً ومدركة للضجيج يحسن جودة الترجمة بشكل كبير ويقدم رؤى قيمة للغات القديمة ذات الموارد المحدودة.

Nasma Chaoui, Richard Khoury2026-05-14
💬 NLP

GLASS: Global-Local Aggregation for Inference-time Sparsification of LLMs

يُعد GLASS إطار عمل لا يتطلب تدريباً يعمل على تحسين التناثر أثناء الاستدلال للنماذج اللغوية الكبيرة من خلال تجميع التنشيطات المحلية الخاصة بالمطالبة والبوادئ الجوهرية العالمية للنموذج عبر تجميع الرتب، مما يؤدي إلى استقرار تقليم الشبكات العصبية المغذية الديناميكية وتعزيز دقة التوليد وسرعة فك التشفير بشكل كبير، لا سيما في سيناريوهات المطالبات القصيرة والنصوص الطويلة.

Amirmohsen Sattarifard, Sepehr Lavasani, Kunlin Zhang, Amirhossein Rajabpour, Hanlin Xu, Fengyu Sun, Negar Hassanpour, C (…)2026-05-14
⚡ electrical engineering

Unifying Diarization, Separation, and ASR with Multi-Speaker Encoder

تقدم هذه الورقة مشفرًا موحدًا متعدد المتحدثين (UME) يتعلم بشكل مشترك تقسيم المتحدثين، وفصل الكلام، والتعرف التلقائي على الكلام متعدد المتحدثين من خلال بنية أساسية مشتركة وتشفير المجموع الموزون المتبقي، محققًا أداءً هو الأفضل في فئته على مجموعات بيانات الكلام المتداخل عبر الاستفادة الفعالة من التبعيات بين المهام.

Muhammad Shakeel, Yui Sudo, Yifan Peng, Chyi-Jiunn Lin, Shinji Watanabe2026-05-14
💬 NLP

Multilingual Vision-Language Models, A Survey

تستعرض هذه الدراسة المسحية 33 نموذجاً لغوياً بصرياً متعدد اللغات و23 معياراً مرجعياً لتسليط الضوء على التوتر الحرج بين تحقيق تمثيلات عابرة للغات محايدة لغوياً وبين الحفاظ على الوعي الثقافي، مع تحديد الفجوات الكبيرة بين أهداف التدريب الحالية ومنهجيات التقييم.

Andrei-Alexandru Manea, Jindřich Libovický2026-05-14