💻 computer science

Email in the Era of LLMs

تقدم هذه الورقة "محاكي الموارد البشرية" (HR Simulator)، وهي لعبة تواصل توضح أنه في حين تتفوق النماذج اللغوية الكبيرة (LLMs) غالباً على البشر في سيناريوهات البريد الإلكتروني الرسمي وتُظهر تفضيلات أكثر تجانساً ولباقة، فإن التعاون بين البشر والنماذج اللغوية الكبيرة يعزز معدلات النجاح بشكل كبير، مما يكشف عن فعالية النماذج اللغوية الكبيرة في التواصل المنظم والقصور الحالي في محاكاة الأساليب غير الرسمية التي تفتقر إلى التعاطف والمشابهة للأسلوب البشري.

Dang Nguyen, Harvey Yiyun Fu, Peter West, Chenhao Tan, Ari Holtzman2026-03-24
💬 NLP

Decoding the decoder: Contextual sequence-to-sequence modeling for intracortical speech decoding

تقدم هذه الورقة نموذج تسلسل إلى تسلسل متعدد المهام قائم على تقنية "ترانسفورمر" مع وحدة معايرة مبتكرة تسمى "مشرط المطرقة العصبي" (Neural Hammer Scalpel)، والتي تحقق أداءً فائقاً في فك تشفير الكلام داخل القشرة المخية من خلال التنبؤ المشترك بالوحدات الصوتية والكلمات مع معالجة التباين العصبي اليومي بفعالية.

Michal Olak, Tommaso Boccato, Matteo Ferrante2026-03-24
💬 NLP

Abjad-Kids: An Arabic Speech Classification Dataset for Primary Education

تقدم هذه الورقة البحثية "أبجد كيدز" (Abjad-Kids)، وهي مجموعة بيانات عربية متاحة للعموم للأصوات، تضم ما يقرب من 47,000 عينة صوتية لأطفال تتراوح أعمارهم بين 3 و12 عاماً لمهام التصنيف التعليمي، وتقترح نهجاً هرمياً يعتمد على الشبكات العصبية الالتفافية والذاكرة الطويلة قصيرة المدى (CNN-LSTM) مع تجميع لغوي ثابت يحقق أداءً فائقاً رغم التحديات المتعلقة بفرط التخصيص (overfitting) الناجمة عن محدودية أحجام العينات.

Abdul Aziz Snoubara, Baraa Al_Maradni, Haya Al_Naal, Malek Al_Madrmani, Roaa Jdini, Seedra Zarzour, Khloud Al Jallad2026-03-24
💬 NLP

SciNav: A General Agent Framework for Scientific Coding Tasks

تقدم الورقة البحثية SciNav، وهو إطار عمل لوكيل عام لمهام البرمجة العلمية يستفيد من الأحكام النسبية الزوجية ضمن عملية بحث شجري لاستكشاف واختيار الحلول عالية الجودة بكفاءة تحت ميزانيات مقيدة، متفوقاً بشكل ملحوظ على أساليب التلقين الحالية والوكلاء السابقين عبر مختلف المعايك.

Tianshu Zhang, Huan Sun2026-03-24
💻 computer science

OpenResearcher: A Fully Open Pipeline for Long-Horizon Deep Research Trajectory Synthesis

يقدم OpenResearcher خط إنتاج مفتوح بالكامل، وقابل لإعادة الإنتاج، ويعمل دون اتصال بالإنترنت، يقوم بتوليف أكثر من 97,000 مسار بحث عميق طويل الأمد من مجموعة مستندات تضم 15 مليون مستند، مما يمكّن نموذجًا بـ 30 مليار معلمة و3 مليارات معلمة نشطة (30B-A3B) من تحقيق تحسن في الدقة قدره 34 نقطة في اختبار BrowseComp-Plus مع توفير بيئة محكومة لتحليل استراتيجيات تصميم الوكيل.

Zhuofeng Li, Dongfu Jiang, Xueguang Ma, Haoxiang Zhang, Ping Nie, Yuyu Zhang, Kai Zou, Jianwen Xie, Yu Zhang, Wenhu Chen2026-03-24
💻 computer science

kRAIG: A Natural Language-Driven Agent for Automated DataOps Pipeline Generation

تقدم الورقة البحثية kRAIG، وهو وكيل ذكاء اصطناعي يعمل على أتمتة إنشاء مسارات Kubeflow الجاهزة للإنتاج من اللغة الطبيعية عبر توظيف إطار عمل ReQuesAct لتوضيح قصد المستخدم، والتركيب الأدواتي المعزز بالاسترجاع لتحويل البيانات، والتحقق القائم على النماذج اللغوية الكبيرة لضمان موثوقية ودقة المسار.

Rohan Siva, Kai Cheung, Lichi Li, Ganesh Sundaram2026-03-24
💬 NLP

The production of meaning in the processing of natural language

تتقصى هذه الورقة البحثية السياقية الشبيهة بالكم في النماذج اللغوية الكبيرة من خلال تحليل معامل CHSH S|S| عبر مختلف المقاييس والمعايير، كاشفةً أن هذا المقياس متعامد مع مقاييس الأداء القياسية، بينما تسلط الضوء على تداعيات معلوماتية عميقة للدفاعات ضد حقن الأوامر (prompt injection) والتلاعب الجوهري بالسياقات التفسيرية.

Christopher J. Agostino, Quan Le Thien, Nayan D'Souza, Louis van der Elst2026-03-24
🤖 machine learning

Putnam 2025 Problems in Rocq using Opus 4.6 and Rocq-MCP

تفيد هذه الورقة أن نموذج Claude Opus 4.6، باستخدام أدوات بروتوكول سياق النموذج (Model Context Protocol) لمساعد الإثبات Rocq واستراتيجية "التجميع أولاً، ثم التراجع التفاعلي"، قد حل بشكل مستقل 10 من أصل 12 مسألة من مسابقة بوتنام الرياضية لعام 2025 في بيئة غير متصلة بالإنترنت.

Guillaume Baudart, Marc Lelarge, Tristan Stérin, Jules Viennot2026-03-24
⚡ electrical engineering

ALICE: A Multifaceted Evaluation Framework of Large Audio-Language Models' In-Context Learning Ability

تقدم الورقة البحثية إطار عمل ALICE الذي يكشف أنه بينما تساعد أمثلة التعلم داخل السياق نماذج اللغة والصوت الكبيرة على الالتزام بتنسيقات المخرجات، إلا أنها تفشل باستمرار في تعزيز أداء المهام الجوهرية، بل وتؤدي غالباً إلى تدهوره، مما يشير إلى وجود قصور كبير في قدرة النماذج على الاستفادة من التجذير الدلالي عبر الوسائط من العروض التوضيحية المشروطة صوتياً.

Yen-Ting Piao, Jay Chiehen Liao, Wei-Tang Chien, Toshiki Ogimoto, Shang-Tse Chen, Yun-Nung Chen, Chun-Yi Lee, Shao-Yuan (…)2026-03-24
💬 NLP

Policies Permitting LLM Use for Polishing Peer Reviews Are Currently Not Enforceable

تُثبت هذه الورقة أن أدوات كشف النصوص التي تعمل بالذكاء الاصطناعي الحالية غير قابلة للتطبيق في تحديد استخدام النماذج اللغوية الكبيرة في مراجعات النظراء لأنها تُصنف بشكل متكرر المراجعات المكتوبة بشرياً والتي تم تنقيحها بواسطة الذاء الاصطناعي على أنها ناتجة بالكامل عن الذكاء الاصطناعي، مما يؤدي إلى اتهامات باطلة بسوء السلوك الأكاديمي وتقديرات غير موثوقة لانتهاكات السياسات.

Rounak Saha, Gurusha Juneja, Dayita Chaudhuri, Naveeja Sajeevan, Nihar B Shah, Danish Pruthi2026-03-24