💬 NLP

Attention to Mamba: A Recipe for Cross-Architecture Distillation

تقترح هذه الورقة وصفة تقطير منهجية من مرحلتين تقوم أولاً بتحويل نموذج "ترانسفورمر" (Transformer) إلى نموذج انتباه خطي، ثم تنقل هذه المعرفة إلى بنية "مامبا" (Mamba)، مما ينجح في الحفاظ على أداء النموذج المعلم الأصلي دون الاعتماد على كتل هجينة تجمع بين الانتباه ونماذج الحالة الفراغية (Attention-SSM).

Abhinav Moudgil, Ningyuan Huang, Eeshan Gunesh Dhekane, Pau Rodríguez, Luca Zappella, Federico Danieli2026-04-17
💬 NLP

Chinese Language Is Not More Efficient Than English in Vibe Coding: A Preliminary Study on Token Cost and Problem-Solving Rate

تُفند هذه الدراسة الأولية الادعاء بأن المطالبات باللغة الصينية أكثر كفاءة في استهلاك الرموز (tokens) من اللغة الإنجليزية في مهام البرمجة لنماذج اللغات الكبيرة، وتكشف بدلاً من ذلك أن المطالبات باللغة الصينية غالباً ما تؤدي إلى معدلات نجاح أقل وتكاليف رموز تعتمد على النموذج ولا تحقق التوفير المتوقع.

Simiao Ren (Tsang), Xingyu Shen (Tsang), Yuchen Zhou (Tsang), Dennis (Tsang), Ng, Ankit Raj2026-04-17
💬 NLP

CROP: Token-Efficient Reasoning in Large Language Models via Regularized Prompt Optimization

تقترح الورقة البحثية طريقة CROP، وهي طريقة لتحسين الأوامر (prompt optimization) تتضمن تنظيم الطول لتقليل استهلاك الرموز (tokens) وزمن الاستجابة بشكل كبير في النماذج اللغوية الكبيرة مع الحفاظ على دقة استدلال تنافسية.

Deep Shah, Sanket Badhe, Nehal Kathrotia, Priyanka Tiwari2026-04-17
💬 NLP

Neuro-Oracle: A Trajectory-Aware Agentic RAG Framework for Interpretable Epilepsy Surgical Prognosis

تقدم الورقة البحثية Neuro-Oracle، وهو إطار عمل استرجاع معزز توليدي (RAG) وكيلِيّ ثلاثي المراحل يستفيد من متجهات مسار التصوير بالرنين المغناطو لقبل وبعد الجراحة الطولية لاسترجاع حالات جراحية مماثلة وتوليد تنبؤات مفسرة لنوبات الصرع، مما يظهر أداءً فائقاً على النماذج المرجعية الثابتة مع توفير مبررات سريرية مهيكلة وخالية من الهلوسة.

Aizierjiang Aiersilan, Mohamad Koubeissi2026-04-17
💬 NLP

MEME-Fusion@CHiPSAL 2026: Multimodal Ablation Study of Hate Detection and Sentiment Analysis on Nepali Memes

تقدم هذه الورقة البحثية MEME-Fusion، وهي بنية انتباه هجينة عابرة للأنماط تتفوق بشكل كبير على النماذج المرجعية المعتمدة على النصوص فقط في اكتشاف خطاب الكراهية والمشاعر في الميمات (memes) بلغة النيبالية ذات الموارد المنخفضة، وذلك من خلال الدمج الديناميكي لتشفيرات CLIP وBGE-M3، بينما تكشف في الوقت ذاته عن القيود الحرجة لنماذج الرؤية التي تركز على اللغة الإنجليزية والنماذج التجميعية القياسية في البيئات التي تستخدم خط "ديفاناغاري" وتفتقر إلى البيانات.

Samir Wagle, Reewaj Khanal, Abiral Adhikari2026-04-17
💬 NLP

ReviewGrounder: Improving Review Substantiveness with Rubric-Guided, Tool-Integrated Agents

تقدم هذه الورقة ReviewGrounder، وهو إطار عمل متعدد الوكلاء موجه بالمعايير ومتكامل مع الأدوات، يعمل على تحسين جوهر وجودة المراجعات العلمية المولدة بواسطة الذكاء الاصطنا_عي والمستندة إلى الأدلة بشكل كبير من خلال تفكيك العملية إلى مرحلتي الصياغة والتأسيد، متفوقاً بذلك على النماذج المرجعية الأكبر حجماً في اختبار ReviewBench المقترح حديثاً.

Zhuofeng Li, Yi Lu, Dongfu Jiang, Haoxiang Zhang, Yuyang Bai, Chuan Li, Yu Wang, Shuiwang Ji, Jianwen Xie, Yu Zhang2026-04-17
💬 NLP

EuropeMedQA Study Protocol: A Multilingual, Multimodal Medical Examination Dataset for Language Model Evaluation

يقدم بروتوكول الدراسة هذا EuropeMedQA، وهو أول مجموعة بيانات طبية شاملة متعددة اللغات والوسائط مستمدة من الامتحانات التنظيمية الأوروبية الرسمية، والمصممة لتقييم وتحسين قدرات الاستدلال عبر اللغات والقدرات البصرية للنماذج اللغوية الكبيرة في السياقات السريرية بدقة.

Francesco Andrea Causio, Vittorio De Vita, Olivia Riccomi, Michele Ferramola, Federico Felizzi, Antonio Cristiano, Loren (…)2026-04-17
💬 NLP

Tracking the Temporal Dynamics of News Coverage of Catastrophic and Violent Events

تحلل هذه الدراسة مجموعة ضخمة من النصوص تضم أكثر من 126,000 مقال إخباري لتثبت أن تغطية الأحداث العنيفة والكارثية تتبع أنماطاً زمنية ودلالية يمكن التنبؤ بها، تتميز بطفرات سريعة، وتحولات سردية مبكرة، وانخفاضات تدريجية مدفوعة بمصطلحات رئيسية محددة.

Emily Lugos, Maurício Gruppi2026-04-17
💬 NLP

LLM Predictive Scoring and Validation: Inferring Experience Ratings from Unstructured Text

تُظهر هذه الدراسة أن نموذج GPT-4.1 يمكنه استنتاج تقييمات التجربة الإجمالية لمشجعي البيسبول بدقة من النصوص غير المهيكلة وباتساق عالٍ، مما يكشف عن أنه بينما يلتقط الذكاء الاصطناعي اللحظات البارزة والمكثفة عاطفيًا، فإن تقديره المنخفض بشكل منهجي مقارنة بالدرجات المبلغ عنها ذاتيًا يعكس اختلافًا جوهريًا بين تركيز النموذج على الأحداث التي لا تُنسى وبين التقييم الشمولي للمشجعين.

Jason Potteiger, Andrew Hong, Ito Zapata2026-04-17
💬 NLP

Shuffle the Context: RoPE-Perturbed Self-Distillation for Long-Context Adaptation

تقترح هذه الورقة البحثية "التقطير الذاتي المشوب بـ RoPE" (RoPE-Perturbed Self-Distillation)، وهو منظم تدريب يعزز التكيف مع السياقات الطويلة في النماذج اللغوية الكبيرة من خلال تشويب مؤشرات تضمين الموضع الدوراني لإنشاء رؤى تسلسلية بديلة، مما يشجع على الاعتماد الدلالي بدلاً من التبعيات الموضعية الهشة، ويحسن الأداء بشكل كبير في معايير السياق الطويل والاستقراء الطولي.

Zichong Li, Chen Liang, Liliang Ren, Tuo Zhao, Yelong Shen, Weizhu Chen2026-04-17