🤖 AI

PONTE: Personalized Orchestration for Natural Language Trustworthy Explanations

يُعد PONTE إطار عمل يعتمد على وجود الإنسان في الحلقة، وهو يعمل على تعزيز موثوقية وتخصيص سرديات الذكاء الاصطناه التفسيري من خلال نمذجة تكيف المستخدم كعملية مغلقة الحلقة تتضمن نمذجة التفضيلات، والتوليد المرتكز على الحقائق، والتحقق المتكرر للتغلب على قيود النهج الموحد للجميع وهلوسات النماذج اللغوية الكبيرة.

Vittoria Vineis, Matteo Silvestri, Lorenzo Antonelli, Filippo Betello, Gabriele Tolomei2026-03-09
🤖 AI

NOBLE: Accelerating Transformers with Nonlinear Low-Rank Branches

تقدم الورقة البحثية NOBLE، وهي بنية تدريب مسبق تعزز بشكل دائم طبقات المحولات الخطية بفروع منخفضة الرتبة قابلة للتعلم وغير خطية (باستخدام تنشيط CosNet تحديداً)، مما يحقق كفاءة تدريب وتسريعاً ملحوظاً عبر نماذج متنوعة مع حد أدنى من التكاليف الإضافية في المعلمات والوقت، رغم أن فوائدها قد تتعرقل بسبب بعض عمليات تعزيز البيانات العشوائية.

Ethan Smith (Canva Research)2026-03-09
🤖 AI

COLD-Steer: Steering Large Language Models via In-Context One-step Learning Dynamics

يُعد COLD-Steer إطار عمل لا يتطلب تدريباً يقوم بتوجيه النماذج اللغوية الكبيرة عبر تقريب التغييرات التمثيلية لعملية الانحدار الاشتقاقي على أمثلة السياق، محققاً فعالية توجيه تصل إلى 95% بـ 50 ضعف أقل من العينات مقارنة بالطرق الحالية.

Kartik Sharma, Rakshit S. Trivedi2026-03-09
💬 NLP

KCLarity at SemEval-2026 Task 6: Encoder and Zero-Shot Approaches to Political Evasion Detection

تفصّل ورقة فريق KCLarity البحثية المقدمة لـ SemEval-2026 تقييمهم المقارن للنماذج القائمة على المشفر (encoder-based) والنماذج القائمة على فك التشفير ذات القدرة على التعلم من الصفر (zero-shot decoder-only) للكشف عن التهرب السياسي، حيث وجدوا أنه في حين تفوق نموذج RoBERTa-large على مجموعة الاختبار العامة، أظهر نموذج GPT-5.2 قدرة فائقة على التعميم على مجموعة التقييم المخفية.

Archie Sage, Salvatore Greco2026-03-09
💻 computer science

EHRSQL: A Practical Text-to-SQL Benchmark for Electronic Health Records

تقدم هذه الورقة EHRSQL، وهو معيار مرجعي عملي لتحويل النص إلى SQL للسجلات الصحية الإلكترونية مبني من استعلامات حقيقية لموظفي المستشفيات، والذي يتحدى النماذج للتعامل مع الاحتياجات السريرية المتنوعة، والتعبيرات الزمنية المعقدة، والأسئلة غير القابلة للإجابة لسد الفجوة بين الأبحاث والنشر في مجال الرعاية الصحية.

Gyubok Lee, Hyeonji Hwang, Seongsu Bae, Yeonsu Kwon, Woncheol Shin, Seongjun Yang, Minjoon Seo, Jong-Yeup Kim, Edward Ch (…)2026-03-06
💻 computer science

INMS: Memory Sharing for Large Language Model based Agents

تقترح هذه الورقة إطار عمل INMS، وهو إطار عمل متعدد الوكلاء غير متزامن يؤسس مجمع ذاكرة محادثة مشترك من خلال التصفية والاسترجاع في الوقت الفعلي، مما يتيح التبادل الديناميكي للمعرفة والتعزيز الذاتي الجماعي لتحسين أداء الوكلاء القائمين على النماذج اللغوية الكبيرة بشكل كبير في السيناريوهات مفتوحة النهايات.

Hang Gao, Yongfeng Zhang2026-03-06
💻 computer science

Vector Retrieval with Similarity and Diversity: How Hard Is It?

تتناول هذه الورقة التحديات النظرية والعملية المتمثلة في الموازنة بين التشابه والتنوع في استرجاع المتجهات الكثيفة من خلال التعريف الرسمي لمشكلة (VRSD) التي تنتمي لفئة المسائل غير الحتمية متعددة الحدود (NP-complete)، واقتراح خوارزمية استدلالية جديدة خالية من المعلمات تتفوق على الأساليب الحالية مثل (MMR) و(k-DPP).

Hang Gao, Dong Deng, Yongfeng Zhang2026-03-06
💻 computer science

Computational Fact-Checking of Online Discourse: Scoring scientific accuracy in climate change related news articles

تقدم هذه الورقة سير عمل شبه مؤتمت باستخدام النماذج اللغوية الكبيرة والرسوم البيانية للمعرفة لقياس الدقة العلمية لأخبار تغير المناخ، حيث وجدت أنه في حين توفر الأدوات التي تم التحقق منها من قبل الخبراء مؤشرات مفيدة على الصحة، فإن القيود الحالية في اكتمال الرسوم البيانية للمعرفة ونطاق المعالجة تعيق التطبيق الواسع النطاق.

Tim Wittenborg, Constantin Sebastian Tremel, Markus Stocker, Sören Auer2026-03-06
💻 computer science

Ice Cream Doesn't Cause Drowning: Benchmarking LLMs Against Statistical Pitfalls in Causal Inference

تقدم هذه الورقة CausalPitfalls، وهو معيار مرجعي شامل صُمم لتقييم وكشف أوجه القصور الكبيرة في النماذج اللغوية الكبيرة في التعامل مع عثرات الاستدلال السببي الإحصائي، مثل مفارقة سيمبسون، وذلك من خلال بروتوكولات التلقين المباشرة والمساعدة بالكود.

Jin Du, Li Chen, Xun Xian, An Luo, Fangqiao Tian, Ganghua Wang, Charles Doss, Xiaotong Shen, Jie Ding2026-03-06
💻 computer science

ShIOEnv: A Command Evaluation Environment for Grammar-Constrained Synthesis and Execution Behavior Modeling

تقدم هذه الورقة ShIOEnv، وهو بيئة Bash ذاتية الإشراف ومقيدة بالقواعد، تولد 2.1 مليون زوج من المدخلات والمخرجات المرتكزة على النظام لتحسين دقة نمذجة سلوكيات تنفيذ سطر الأوامر المعقدة بشكل كبير مقارنة بالنهج السابقة الخالية من التنفيذ.

Jarrod Ragsdale, Rajendra Boppana2026-03-06