💬 NLP

DTCRS: Dynamic Tree Construction for Recursive Summarization

تقدم الورقة البحثية طريقة DTCRS، التي تقوم ببناء أشجار تلخيص تكرارية ديناميكياً من خلال تحليل أنواع الأسئلة واستخدام تضمينات الأسئلة الفرعية كمراكز عناقيد للقضاء على العقد الزائدة، مما يقلل من وقت البناء ويحسن الأداء في مهام الإجابة على الأسئلة القائمة على الاستدلال متعدد الخطوات.

Guanran Luo, Zhongquan Jian, Wentao Qiu, Meihong Wang, Qingqiang Wu2026-04-09
💬 NLP

Corpora deduplication or duplication in Natural Language Processing of few resourced languages ? A case of study: The Mexico's Nahuatl

تبحث هذه الورقة فيما إذا كان تكرار البيانات المنضبط يمكن أن يعزز بفعالية معالجة اللغات الطبيعية للغات ذات الموارد المنخفضة، حيث تُظهر أن تقنية التكرار التدريجي المطبقة على متن لغة الناواتل تحقق تحسينات متوسطة في مهام التشابه الدلالي على مستوى الجملة.

Juan-José Guzman-Landa, Juan-Manuel Torres-Moreno, Graham Ranger, Miguel Figueroa-Saavedra, Martha-Lorena Avendaño-Garri (…)2026-04-09
💬 NLP

MARS: Enabling Autoregressive Models Multi-Token Generation

تُعد MARS طريقة ضبط دقيق خفيفة الوزن تُمكّن النماذج اللغوية ذات التوليد الذاتي من توليد عدة رموز في كل تمريرة أمامية دون تغييرات هيكلية أو معاملات إضافية، محققةً إنتاجية تبلغ 1.5-1.7 ضعفاً مع الحفاظ على دقة النموذج الأساسي وتوفير تعديل فوري للسرعة عبر عتبة الثقة.

Ziqi Jin, Lei Wang, Ziwei Luo, Aixin Sun2026-04-09
💬 NLP

Gemma 4, Phi-4, and Qwen3: Accuracy-Efficiency Tradeoffs in Dense and MoE Reasoning Language Models

تقدم هذه الورقة بحثاً تجريبياً شاملاً لسبعة نماذج لغوية للاستدلال، تتنوع بين النماذج الكثيفة ونماذج "خليط الخبراء" (MoE)، عبر مهام واستراتيجيات صياغة متعددة، مما يثبت أن التنشيط المتفرق وحده لا يضمن الأداء الأمثل، وأن أفضل المقايضات بين الدقة والكفاءة تعتمد على التفاعل المحدد بين البنية الهيكلية، وبروتوكول الصياغة، وتكوين المهام.

Md Motaleb Hossen Manik, Ge Wang2026-04-09
💬 NLP

ReDAct: Uncertainty-Aware Deferral for LLM Agents

تقترح الورقة البحثية إطار عمل ReDAct، وهو إطار عمل للتأجيل يراعي عدم اليقين يقوم بتوجيه القرارات استراتيجياً من نموذج لغوي كبير (LLM) صغير ومنخفض التكلفة إلى نموذج أكبر وأكثر موثوقية فقط عندما يتجاوز عدم اليقين حداً معيناً، مما يحقق أداءً مقارباً لاستخدام النموذج الكبير حصرياً مع تقليل تكاليف الاستدلال بشكل كبير.

Dzianis Piatrashyn, Nikita Kotelevskii, Kirill Grishchenkov, Nikita Glazkov, Ivan Nasonov, Ilya Makarov, Timothy Baldwin (…)2026-04-09
💬 NLP

Sell More, Play Less: Benchmarking LLM Realistic Selling Skill

تقدم هذه الورقة SalesLLM، وهو معيار ثنائي اللغة ومسار تقييم تلقائي مصمم لتقييم مهارات التفاوض البيعي الواقعية للنماذج اللغوية الكبيرة باستخدام 1,805 سيناريو منسق وCustomerLM مدرب، مما يكشف عن تباين كبير في الأداء بين النماذج وارتباط قوي مع تقييمات الخبراء البشريين.

Xuanbo Su, Wenhao Hu, Le Zhan, Yanqi Yang, Leo Huang2026-04-09
💬 NLP

IndoBERT-Sentiment: Context-Conditioned Sentiment Classification for Indonesian Text

تقدم الورقة البحثية نموذج IndoBERT-Sentiment، وهو مصنف مشروط بالسياق مبني على نموذج IndoBERT Large يتفوق بشكل كبير على نماذج تحليل المشاعر الحالية للغة الإندونيسية من خلال دمج السياق الموضوعي لحل حالات الغموض التي تتسبب في فشل النهج غير المشروطة بالسياق.

Muhammad Apriandito Arya Saputra, Andry Alamsyah, Dian Puteri Ramadhani, Thomhert Suprapto Siadari, Hanif Fakhrurroja2026-04-09
💬 NLP

SemEval-2026 Task 3: Dimensional Aspect-Based Sentiment Analysis (DimABSA)

تقدم هذه الورقة المهمة المشتركة SemEval-2026 Task 3، وهي مهمة مشتركة تقدم تحليل المشاعر القائم على الجوانب ذي الأبعاد (DimABSA) وتحليل الموقف ذي الأبعاد (DimStance) لنمذجة المشاعر والموقف عبر أبعاد التكافؤ والاستثارة بدلاً من التصنيفات الفئوية، وتتميز بمسارين مع مهام فرعية متعددة، ومقياس F1 مستمر جديد، ونتائج من أكثر من 400 مشارك.

Liang-Chih Yu, Jonas Becker, Shamsuddeen Hassan Muhammad, Idris Abdulmumin, Lung-Hao Lee, Ying-Lung Lin, Jin Wang, Jan P (…)2026-04-09
💬 NLP

Is Cross-Lingual Transfer in Bilingual Models Human-Like? A Study with Overlapping Word Forms in Dutch and English

تتقصى هذه الدراسة ما إذا كانت النماذج اللغوية ثنائية اللغة (هولندي-إنجليزي) تحاكي أنماط التنشيط عبر اللغات لدى البشر أثناء القراءة، حيث وجدت أنه بينما يمكن للتمثيلات المتجهة المشتركة أن تسبب تأثيرات التسهيل أو التداخل، فإن توافق النماذج مع المعالجة البشرية يعتمد بشكل حاسم على تكوينات محددة لمشاركة المفردات ويكون مدفوعاً في المقام الأول بتكرار الكلمات بدلاً من اتساق الشكل والمعنى.

Iza Škrjanec, Irene Elisabeth Winther, Vera Demberg, Stefan L. Frank2026-04-09
💬 NLP

The Impact of Steering Large Language Models with Persona Vectors in Educational Applications

تُظهر هذه الدراسة بشكل منهجي أنه في حين يسمح توجيه الشخصية القائم على التنشيط بتخصيص النماذج في البيئات التعليمية، فإنه يؤدي بشكل كبير إلى تدهور جودة الإجابات ويسبب تحيزات متوقعة في التقييم، مع تباين التأثيرات بشكل كبير حسب نوع المهمة (كونها أكثر وضوحاً في فنون اللغة الإنجليزية مقارنة بالعلوم) وبنية النموذج.

Yongchao Wu, Aron Henriksson2026-04-09