💬 NLP

CIRCUS: Circuit Consensus under Uncertainty via Stability Ensembles

يُعدُّ CIRCUS إطار عمل لاحقاً (post-hoc) يعالج حساسية اكتشاف الدوائر الميكانيكية تجاه الخيارات التعسفية للمحلل عبر بناء مجموعات استقرار لاستخراج دائرة توافقية متينة وواعية بالشك، تتفوق على النماذج المرجعية التقليدية في كل من الإيجاز والارتباط السببي.

Swapnil Parekh2026-03-03
💬 NLP

QQ: A Toolkit for Language Identifiers and Metadata

تقدم هذه الورقة البحثية QwanQwa (QQ)، وهي مجموعة أدوات بايثون خفيفة الوزن توحد موارد بيانات اللغة المتنوعة لتبسيط عمليات تطبيع المعرفات، والتعيين، والاستكشاف عبر آلاف اللغات لأبحاث معالجة اللغات الطبيعية متعددة اللغات.

Wessel Poelman, Yiyi Chen, Miryam de Lhoneux2026-03-03
💬 NLP

TraceSIR: A Multi-Agent Framework for Structured Analysis and Reporting of Agentic Execution Traces

يُعد TraceSIR إطار عمل متعدد الوكلاء يعالج تحديات تحليل آثار التنفيذ الوكيلية المعقدة من خلال توظيف وكلاء متخصصين لضغط البيانات، وإجراء تحليل دقيق للأسباب الجذرية، وتوليد تقارير قابلة للتنفيذ، مُظهراً أداءً فائقاً في معايير TraceBench وReportEval المستحدثة.

Shu-Xun Yang, Cunxiang Wang, Haoke Zhang, Wenbo Yu, Lindong Wu, Jiayi Gui, Dayong Yang, Yukuo Cen, Zhuoer Feng, Bosi Wen (…)2026-03-03
💬 NLP

SSKG Hub: An Expert-Guided Platform for LLM-Empowered Sustainability Standards Knowledge Graphs

تُعد منصة SSKG Hub منصة إلكترونية يوجهها الخبراء وتستفيد من النماذج اللغوية الكبيرة لتحويل معايير الاستدامة المعقدة إلى رسوم بيانية معرفية قابلة للتدقيق ومرتبطة بمصدر موثوق، وتتميز بمسار عمل دقيق متعدد المراحل للتقييم يضمن إمكانية التتبع والجودة من خلال حوكمة قائمة على الأدوار وفصل في الأحكام من قبل الخبراء.

Chaoyue He, Xin Zhou, Xinjia Yu, Lei Zhang, Yan Zhang, Yi Wu, Lei Xiao, Liangyue Li, Di Wang, Hong Xu, Xiaoqiao Wang, We (…)2026-03-03
💬 NLP

Constitutional Black-Box Monitoring for Scheming in LLM Agents

تُثبت هذه الورقة أن أدوات المراقبة الدستورية القائمة على النماذج اللغوية الكبيرة ذات الصندوق الأسود، والتي تم تحسينها باستخدام بيانات اصطناعية ناتجة عن مواصفات سلوكية بلغة طبيعية، يمكنها التعميم بفعالية للكشف عن المخططات في بيئات الوكلاء الواقعية، رغم أن أداءها يتشبع بسرعة مع عمليات مسح المطالبات البسيطة، مما لا يحقق أي مكاسب إضافية من التحسين المكثف.

Simon Storf, Rich Barton-Cooper, James Peters-Gill, Marius Hobbhahn2026-03-03
💬 NLP

Learning Nested Named Entity Recognition from Flat Annotations

تبحث هذه الورقة في طرق تعلم التعرف على الكيانات المسماة المتداخلة من التوسيمات المسطحة الوفيرة، حيث تُظهر أن نهجاً هجيناً يجمع بين تضمين السلاسل النصية، وإفساد الكيانات، وتحييد التوسيم المسطح، والضبط الدقيق للنماذج اللغوية الكبيرة، يمكنه استعادة 40% من فجوة الأداء مقارنة بالإشراف المتداخل الكامل على معيار NEREL الروسي.

Igor Rozhkov, Natalia Loukachevitch2026-03-03
💬 NLP

MedGPT-oss: Training a General-Purpose Vision-Language Model for Biomedicine

تقدم الورقة البحثية MEDGPT-OSS، وهو نموذج رؤية ولغة مفتوح الأوزان بـ 20 مليار معلمة، والذي يسد فجوة النشر في الذكاء الاصطناقي السريري من خلال تفوقه على النماذج الطبية المفتوحة الأكبر حجماً في المهام المعقدة متعددة الوسائط والنصوص فقط، مع الحفاظ على بصمة كفؤة من حيث عدد المعلمات لتناسب الاستخدام المحلي الذي يحافظ على الخصوصية.

Kai Zhang, Zhengqing Yuan, Cheng Peng, Songlin Zhao, Mengxian Lyu, Ziyi Chen, Yanfang Ye, Wei Liu, Ying Zhang, Kaleb E S (…)2026-03-03
💬 NLP

CHIMERA: Compact Synthetic Data for Generalizable LLM Reasoning

تقدم الورقة البحثية CHIMERA، وهي مجموعة بيانات اصطناعية مدمجة ومؤتمتة بالكامل تتكون من 9 آلاف عينة استدلال عالية الجودة ومتعددة المجالات، والتي تمكن نموذجاً صغيراً بحجم 4 مليارات معلمة من تحقيق أداء في الاستدلال يضاهي النماذج الرائدة الأكبر حجماً من خلال التغلب على تحديات البداية الباردة، وتغطية المجالات، وعقبة التوسيم.

Xinyu Zhu, Yihao Feng, Yanchao Sun, Xianzhi Du, Pingzhi Li, Olli Saarikivi, Yun Zhu, Yu Meng2026-03-03
💬 NLP

Hybrid Neural-LLM Pipeline for Morphological Glossing in Endangered Language Documentation: A Case Study of Jungar Tuvan

تقدم هذه الورقة مساراً هجيناً يجمع بين الشبكات العصبية والنماذج اللغوية الكبيرة للتحليل الصرفي التلقائي للغة "جونغار توفان" المهددة بالانقراض، مما يثبت أن الجمع بين نموذج وسم المتواليات (BiLSTM-CRF) والتصحيح اللاحق بواسطة النماذج اللغوية الكبيرة يقلل بشكل كبير من عبء العمل في التوسيم، ويضع مبادئ تصميمية مثل تفوق أسلوب التلقين المعزز بالاسترجاع على الأساليب القائمة على القواميس بالنسبة للغات ذات الموارد المنخفضة والغنية صرفياً.

Siyu Liang, Talant Mawkanuli, Gina-Anne Levow2026-03-03
💬 NLP

The Aftermath of DrawEduMath: Vision Language Models Underperform with Struggling Students and Misdiagnose Errors

تُظهر هذه الورقة أن نماذج الرؤية واللغة الحالية تعاني من ضعف ملحوظ عند تحليل الأعمال الطلابية المكتوبة بخط اليد، لا سيال تحديد وتشخيص الأخطاء التي يرتكبها المتعلمون المتعثرون، مما يسلط الضوء على فجوة حرجة بين قدراتها في حل المشكلات والاحتياجات المحددة للتطبيقات التعليمية.

Li Lucy, Albert Zhang, Nathan Anderson, Ryan Knight, Kyle Lo2026-03-03