💬 NLP

iPhoneme: Brain-to-Text Communication for ALS Using ConformerXL Decoding

تقدم الورقة البحثية نظام iPhoneme، وهو نظام اتصال من الدماغ إلى النص عالي الأداء لمرضى التصلب الجانبي الضموري (ALS)، يجمع بين وحدة فك تشفير عصبية من نوع ConformerXL المعدلة وواجهة كلام صامت مدعومة بتتبع حركة العين لتحقيق دقة في الفونيمات بنسبة 92.14% والتشغيل في الوقت الفعلي على أجهزة المعالجة المركزية (CPU).

Yoonmin Cha, Dawit Chun, Sung Park2026-04-21
💬 NLP

EchoChain: A Full-Duplex Benchmark for State-Update Reasoning Under Interruptions

تقدم الورقة البحثية EchoChain، وهو معيار جديد مصمم لتقييم وتشخيص الإخفاقات الجسيمة للمساعدات الصوتية في الوقت الفعلي عند تحديث حالات المهام عند المقاطعة أثناء التحدث، مما يكشف عن معاناة الأنظمة الحالية من القصور الذاتي السياقي، وفقدان الذاكرة الناتج عن المقاطعة، وإزاحة الأهداف.

Smit Nautambhai Modi, Gandharv Mahajan, Marc Wetter, Randall Welles2026-04-21
💬 NLP

NL2SQLBench: A Modular Benchmarking Framework for LLM-Enabled NL2SQL Solutions

تقدم هذه الورقة NL2SQLBench، وهو أول إطار عمل معياري لتقييم الأداء يقوم بتفكيك أنظمة NL2SQL إلى وحدات اختيار المخطط (Schema Selection)، وتوليد المرشحين (Candidate Generation)، ومراجعة الاستعلام (Query Revision) لتوفير مقاييس دقيقة لتقييم الفعالية والكفاءة، مما يكشف عن فجوات كبيرة في الدقة والحوسبة في الطرق الحالية مع تسليط الضوء على العيوب الجوهرية في مجموعات البيانات وقواعد التقييم الحالية.

Shizheng Hou, Wenqi Pei, Nuo Chen, Quang-Trung Ta, Peng Lu, Beng Chin Ooi2026-04-21
💬 NLP

SQL Query Engine: A Self-Healing LLM Pipeline for Natural Language to PostgreSQL Translation

تقدم هذه الورقة "SQL Query Engine"، وهو خدمة مفتوحة المصدر ومستضافة ذاتياً تقوم بترجمة اللغة الطبيعية إلى استعلامات PostgreSQL تم التحقق من صحتها باستخدام خط معالجة يعتمد على نماذج لغوية كبيرة (LLM) يتكون من مرحلتين، ويتميز بالاستبطان التلقائي للمخطط (schema introspection)، ومحلل استجابة مرن، وحلقة إصلاح ذاتي تكرارية تعزز دقة التنفيذ بشكل كبير مع ضمان سلامة القراءة فقط وعدم حدوث أي تراجعات.

Muhammad Adeel Ijaz2026-04-21
🤖 machine learning

S-GRPO: Unified Post-Training for Large Vision-Language Models

تقترح الورقة البحثية إطار عمل S-GRPO، وهو إطار عمل موحد لما بعد التدريب للنماذج اللغوية البصرية الضخمة يدمج بين الضبط الدقيق الخاضع للإشراف والتعلم المعزز عبر حقن مسار الحقيقة الأرضية الشرطي للتغلب على قيود النسيان الكارثي وانهيار التحسين، مما يؤدي إلى تسريع التقارب وتحقيق تكيف نطاقي متفوق مع الحفاظ على القدرات العامة.

Yuming Yan, Kai Tang, Sihong Chen, Ke Xu, Dan Hu, Qun Yu, Pengfei Hu2026-04-21
💬 NLP

On the Robustness of LLM-Based Dense Retrievers: A Systematic Analysis of Generalizability and Stability

تقدم هذه الورقة أول تحليل منهجي لمتانة أنظمة الاسترجاع الكثيفة القائمة على النماذج اللغوية الكبيرة (LLMs) ذات الحالة الراهنة، كاشفةً أنه في حين تتفوق النماذج المضبوطة بالتعليمات وتوفر استقراراً محسناً ضد الأخطاء المطبعية وتسميم المتون، إلا أنها تواجه "ضريبة تخصص" في القدرة على التعميم وتظل عرضة للاضطرابات الدلالية، مع تحديد الهندسة التضمينية وتوسع النموذج كعوامل رئيسية تؤثر على الأداء.

Yongkang Li, Panagiotis Eustratiadis, Yixing Fan, Evangelos Kanoulas2026-04-21
💬 NLP

Aligning Backchannel and Dialogue Context Representations via Contrastive LLM Fine-Tuning

تقترح هذه الورقة إطار عمل للضبط الدقيق التبايني يتكون من مرحلتين يعمل على محاذاة تمثيلات سياق الحوار مع تجليات الاستجابات الارتدادية (backchannel)، مما يثبت أن التضمينات الناتجة تلتقط العلاقة بين السياق الحواري وشكل الاستجابة الارتدادية بشكل أفضل من الطرق السابقة وتتماشى بشكل وثيق مع الأحكام البشرية.

Livia Qian, Gabriel Skantze2026-04-21
💬 NLP

AdaExplore: Failure-Driven Adaptation and Diversity-Preserving Search for Efficient Kernel Generation

تُعد AdaExplore إطار عمل وكيل مبتكر يعزز توليد كود النواة المدفوع بالنماذج اللغوية الكبيرة للغات المحددة بمجال معين مثل Triton، وذلك عبر الجمع بين التكيف القائم على الفشل لبناء قواعد صلاحية قابلة لإعادة الاستخدام وبين البحث المحافظ على التنوع للتنقل في مشهديات التحسين المعقدة، محققاً بذلك تسريعات كبيرة دون الحاجة إلى ضبط دقيق إضافي.

Weihua Du, Jingming Zhuo, Yixin Dong, Andre Wang He, Weiwei Sun, Zeyu Zheng, Manupa Karunaratne, Ivan Fox, Tim Dettmers (…)2026-04-21
💬 NLP

IYKYK (But AI Doesn't): Automated Content Moderation Does Not Capture Communities' Heterogeneous Attitudes Towards Reclaimed Language

تُثبت هذه الورقة أن أدوات الإشراف الآلي على المحتوى تخفق في استيعاب المواقف المتباينة والذاتية للمجتمعات المهمشة تجاه الألفاظ المستعادة، مما يؤدي إلى تصنيف اللغة القائمة على التضامن خطأً على أنها خطاب كراهية بسبب الافتقار إلى الفهم السياقي والتباين الكبير حتى بين أفراد المجموعة الواحدة.

Christina Chance, Rebecca Pattichis, Arjun Subramonian, James He, Shruti Narayanan, Saadia Gabriel, Kai-Wei Chang2026-04-21
💬 NLP

Defragmenting Language Models: An Interpretability-based Approach for Vocabulary Expansion

تتناول هذه الورقة مسألة الإفراط في تجزئة الرموز (token over-fragmentation) في اللغات غير اللاتينية من خلال اقتراح FragMend، وهي طريقة لتوسيع المفردات قائمة على القابلية للتفسير، تتفوق على تقنيات الاختيار والتهيئة التقليدية القائمة على التكرار، مما يؤدي إلى تحسين الأداء وكفاءة الرموز بشكل كبير.

Maitrey Mehta, Nishant Subramani, Zhichao Xu, Ashim Gupta, Vivek Srikumar2026-04-21