💬 NLP

MetaKE: Meta-learning Aligned Knowledge Editing via Bi-level Optimization

تقترح هذه الورقة MetaKE، وهو إطار عمل مبتكر يعيد صياغة تحرير المعرفة كمسألة تحسين ثنائية المستوى مع هدف تحرير قابل للتعلم ووكيل تدرج هيكلي لحل الانفصال بين الدلالة والتنفيذ، مما يؤدي إلى تحسين معدلات نجاح التحرير وأداء النموذج بشكل كبير مقارنة بالطرق الحالية.

Shuxin Liu, Ou Wu2026-03-16
🤖 AI

AI Planning Framework for LLM-Based Web Agents

تقترح هذه الورقة إطار عمل للتخطيط بالذكاء الاصطناعي يقوم بربط بنيات الوكلاء القائمة على النماذج اللغوية الكبيرة (LLM) بنماذج البحث التقليدية (البحث بالعرض، والبحث بالعمق، والبحث بالأفضل أولاً) لتمكين التشخيص المنهجي للفشل، مع تقديم مقاييس تقييم جديدة ومجموعة بيانات مصنفة بشرياً لإثبات أن استراتيجيات الوكلاء المختلفة تتفوق في جوانب متميزة من تنفيذ المهام، مثل التوافق مع المسار البشري مقابل دقة العناصر التقنية.

Orit Shahnovsky, Rotem Dror2026-03-16
💬 NLP

MoKus: Leveraging Cross-Modal Knowledge Transfer for Knowledge-Aware Concept Customization

تقدم الورقة البحثية إطار عمل MoKus، وهو إطار عمل مبتكر يستفيد من نقل المعرفة عبر الوسائط لمعالجة قيود ربط الرموز النادرة في تخصيص المفاهيم من خلال دمج المعرفة النصية المتنوعة مع المفاهيم البصرية بفعالية، مصحوباً بمعيار التقييم الجديد KnowCusBench للتقييم.

Chenyang Zhu, Hongxiang Li, Xiu Li, Long Chen2026-03-16
💬 NLP

A Method for Learning Large-Scale Computational Construction Grammars from Semantically Annotated Corpora

تقدم هذه الورقة طريقة للتعلم التلقائي لقواعد نحوية بنائية حوسبية واسعة النطاق وقابلة للتفسير البشري من مدونات لغوية مشروحة دلالياً، مما يثبت قابلية التوسع في مناهج قواعد النحو البنائية القائمة على الاستخدام ويوفر أداة عملية لتحليل الأنماط النحوية-الدلالية في النصوص مفتوحة المجال.

Paul Van Eecke, Katrien Beuls2026-03-16
💬 NLP

CLARIN-PT-LDB: An Open LLM Leaderboard for Portuguese to assess Language, Culture and Civility

تقدم هذه الورقة CLARIN-PT-LDB، وهو أول لوحة صدارة مفتوحة مخصصة لتقييم النماذج اللغوية الكبيرة في اللغة البرتغالية الأوروبية، والتي تتميز بمعايير مرجعية مبتكرة تقيم الكفاءة اللغوية، والمواءمة الثقافية، وضمانات التهذيب.

João Silva, Luís Gomes, António Branco2026-03-16
💬 NLP

DS2^2-Instruct: Domain-Specific Data Synthesis for Large Language Models Instruction Tuning

تقدم الورقة البحثية DS2^2-Instruct، وهو إطار عمل لتعلم التعليمات من نوع (zero-shot)، يقوم بتخليق مجموعات بيانات ضبط دقيق للتعليمات عالية الجودة ومتخصصة في مجالات معينة عبر الجمع بين الكلمات المفتاحية المستنيرة بالمهام وتصنيف بلوم والتحقق من الاتساق الذاتي، مما يؤدي إلى تحسين أداء النماذج اللغوية الكبيرة بشكل كبير في المجالات المتخصصة دون الحاجة إلى تعليق بشري.

Ruiyao Xu, Noelle I. Samia, Han Liu2026-03-16
🤖 AI

Structured Distillation for Personalized Agent Memory: 11x Token Reduction with Retrieval Preservation

تقدم هذه الورقة طريقة تقطير مهيكلة تضغط سجل محادثات الوكيل المخصص إلى ملخصات موجزة مكونة من أربعة حقول بمتوسط 38 رمزاً لكل تبادل، مما يحقق خفضاً بمقدار 11 ضعفاً في استخدام الرموز مع الحفاظ على جودة استرجاع تضاهي أو تتجاوز النماذج المرجعية القائمة على النصوص الأصلية عبر آلاف المحادثات في مجال هندسة البرمجيات.

Sydney Lewis2026-03-16
💬 NLP

Interpretable Semantic Gradients in SSD: A PCA Sweep Approach and a Case Study on AI Discourse

تقدم هذه الورقة إجراء مسح لـ PCA لتحديد العدد الأمثل للمكونات في تحليل التمايز الدلالي الخاضع للإشراف (SSD) بشكل منهجي، مما يقلل من درجات حرية الباحث ويعزز قابلية تفسير التدرجات الدلالية، كما هو موضح في دراسة حالة تربط سمات النرجسية بأطر تمثيل متميزة لخطاب الذكاء الاصطناي.

Hubert Plisiecki, Maria Leniarska, Jan Piotrowski, Marcin Zajenkowski2026-03-16
💬 NLP

ESG-Bench: Benchmarking Long-Context ESG Reports for Hallucination Mitigation

تقدم هذه الورقة ESG-Bench، وهو مجموعة بيانات مرجعية مُوسومة بشرياً صُممت لتقييم والحد من الهلوسة في النماذج اللغوية الكبيرة عند تحليل تقارير الحوكمة البيئية والاجتماعية وحوكمة الشركات المعقدة، مما يثبت أن استخدام أسلوب "سلسلة الأفكار" (Chain-of-Thought) في التلقين والضبط الدقيق على هذه المجموعة من البيانات يحسنان بشكل كبير من الدقة الواقعية والقدرة على التعميم.

Siqi Sun, Ben Peng Wu, Mali Jin, Peizhen Bai, Hanpei Zhang, Xingyi Song2026-03-16
🤖 AI

Semantic Invariance in Agentic AI

تقدم هذه الورقة إطار عمل للاختبار التحولي لتقييم الثبات الدلالي لوكلاء النماذج اللغوية الكبيرة عبر مختلف التحويلات والنماذج، كاشفةً أن استقرار الاستدلال لا يرتبط بحجم النموذج وأن النماذج الأصغر مثل Qwen3-30B-A3B يمكن أن تتفوق على نظيراتها الأكبر في المتانة.

I. de Zarzà, J. de Curtò, Jordi Cabot, Pietro Manzoni, Carlos T. Calafate2026-03-16