💬 NLP

Compressed-Sensing-Guided, Inference-Aware Structured Reduction for Large Language Models

تقترح هذه الورقة إطار عمل موحداً موجهاً بالاستشعار المضغوط، يعمل على تكييف كل من المدخلات التوجيهية وهياكل النموذج الفرعية ديناميكياً أثناء استدلال النماذج اللغوية الكبيرة باستخدام القياسات العشوائية والاسترداد المتناثر لتحديد المسارات النشطة الخاصة بكل مهمة، مما يحقق تقليلاً كبيراً في زمن الاستجابة والذاكرة مع الحفاظ على الدقة من خلال التنفيذ الفعال من حيث الأجهزة.

Andrew Kiruluta2026-04-17
💬 NLP

Can Large Language Models Detect Methodological Flaws? Evidence from Gesture Recognition for UAV-Based Rescue Operation Based on Deep Learning

تُثبت هذه الورقة أن النماذج اللغوية الكبيرة يمكنها العمل بفعالية كوكلاء تحليل مستقلين للكشف عن العيوب المنهجية، مثل تسرب البيانات، في الدراسات المنشورة في مجال تعلم الآلة من خلال تحديد مشكلات التقييم باستمرار في دراسة حالة للتعرف على الإيماءات بناءً على النص الأصلي فقط.

Domonkos Varga2026-04-17
💬 NLP

SeaAlert: Critical Information Extraction From Maritime Distress Communications with Large Language Models

تقدم هذه الورقة SeaAlert، وهو إطار عمل قائم على النماذج اللغوية الكبيرة يستخدم مساراً لتوليد البيانات الاصطناعية لإنشاء نصوص استغاثة بحرية واقعية ومشوبة بالضجيج، مما يتيح استخراج معلومات السلامة الحرجة بمتانة من اتصالات راديو VHF الصعبة حيث تعجز الطرق التقليدية.

Tomer Atia, Yehudit Aperstein, Alexander Apartsin2026-04-17
💬 NLP

How to Fine-Tune a Reasoning Model? A Teacher-Student Cooperation Framework to Synthesize Student-Consistent SFT Data

تقترح الورقة البحثية إطار عمل TESSY، وهو إطار تعاون بين المعلم والطالب يعمل على توليف بيانات التدريب من خلال التداخل بين نموذجي المعلم والطالب لإنشاء تسلسلات تجمع بين قدرات الاستنتاج المتقدمة للمعلم والاتساق الأسلوبي للطالب، مما يتغلب على تدهور الأداء الناتج عن التباين الأسلوبي في عمليات الضبط الدقيق للبيانات الاصطناعية القياسية.

Zixian Huang, Kaichen Yang, Xu Huang, Feiyang Hao, Qiming Ge, Bowen Li, He Du, Kai Chen, Qipeng Guo2026-04-17
💬 NLP

EviSearch: A Human in the Loop System for Extracting and Auditing Clinical Evidence for Systematic Reviews

يُعد EviSearch نظاماً متعدد الوكلاء يعتمد على التدخل البشري، يقوم بأتمتة استخراج الأدلة السريرية المتوافقة مع الأنطولوجيا من ملفات PDF الخاصة بالتجارب مع ضمان توثيق المصدر لكل خلية، مما يحسن الدقة بشكل كبير مقارنة بالنماذج المرجعية القائمة على النصوص، مع تمكين التكامل الآمن والقابل للتدقيق للنماذج اللغوية الكبيرة في سير عمل المراجعات المنهجية.

Naman Ahuja, Saniya Mulla, Muhammad Ali Khan, Zaryab Bin Riaz, Kaneez Zahra Rubab Khakwani, Mohamad Bassam Sonbol, Irbaz (…)2026-04-17
💬 NLP

SAGE Celer 2.6 Technical Card

تُعد SAGE Celer 2.6 عائلة جديدة من النماذج اللغوية للأغراض العامة (5 مليارات، و10 مليارات، و27 مليار معلمة) التي تتميز بقدرات متعددة الوسائط أصيلة، ومسار استدلال عكسي لتقليل الهلوسة، وتحسين متخصص للغات جنوب آسيا مثل الهندية والنيبالية مع الحفاظ على أداء قوي في اللغة الإنجليزية.

SAGEA Research Team, Basab Jha, Firoj Paudel, Ujjwal Puri, Adrian Liu, Ethan Henkel, Zhang Yuting, Mateusz Kowalczyk, Me (…)2026-04-17
💬 NLP

Tug-of-War within A Decade: Conflict Resolution in Vulnerability Analysis via Teacher-Guided Retrieval-Augmented Generations

تقترح هذه الورقة إطار عمل CRVA-TGRAG، وهو إطار عمل ثنائي المراحل يجمع بين تقنيات الاسترجاع المتقدمة وتحسين التفضيلات بتوجيه من المعلم لحل صراعات المعرفة والهلوسة في النماذج اللغوية الكبيرة عند تحليل الثغرات الأمنية السيبرانية التي يتم تحديثها بشكل متكرر.

Ziyin Zhou, Jianyi Zhang, Xu ji, Yilong Li, Jiameng Han, Zhangchi Zhao2026-04-17
💬 NLP

Correcting Suppressed Log-Probabilities in Language Models with Post-Transformer Adapters

تُثبت هذه الورقة أن مُكيِّفًا خفيف الوزن لما بعد مرحلة المحولات (post-transformer adapter)، تم تدريبه على الحالات الخفية المجمدة، يمكنه تصحيح كبح احتمالات السجل الواقعي (factual log-probabilities) في المواضيع السياسية الحساسة في النماذج اللغوية المتوافقة دون إضعاف المعرفة، مع الكشف أيضًا عن خطأ صامت حرج في التدرج (silent gradient bug) في نظام Apple MLX كان قد أبطل سابقًا أبحاثًا مماثلة.

Bryan Sanchez2026-04-17
💬 NLP

Internal Knowledge Without External Expression: Probing the Generalization Boundary of a Classical Chinese Language Model

تُظهر هذه الورقة أنه بينما تمتلك نماذج اللغة الصينية الكلاسيكية معرفة داخلية تسمح لها بالتمييز بين الحقائق المعروفة وغير المعروفة، إلا أنها تفشل في التعبير عن هذا اليقين خارجياً في نصوصها المولدة، مما يشير إلى أن القدرات الميتامعرفية مثل قول "لا أعرف" لا تنبثق من نمذجة اللغة وحدها بل تتطلب إشارات تدريب صريحة.

Jiuting Chen, Yuan Lian, Hao Wu, Tianqi Huang, Hiroshi Sasaki, Makoto Kouno, Jongil Choi2026-04-17
⚡ electrical engineering

HARNESS: Lightweight Distilled Arabic Speech Foundation Models

تقدم الورقة البحثية HArnESS، وهي عائلة من نماذج الكلام ذاتية الإشراف، خفيفة الوزن ومركزة على اللغة العربية، تم تدريبها عبر التقطير الذاتي التكراري من معلم ثنائي اللغة، والتي تحقق أداءً قويًا في مهام الكلام العربية مثل التعرف التلقائي على الكلام، وتحديد اللهجات، والتعرف على العواطف، مع تقديم مكاسب كفاءة كبيرة للنشر في البيئات محدودة الموارد.

Vrunda N. Sukhadia, Shammur Absar Chowdhury2026-04-17