💬 NLP

InfiMed-ORBIT: Aligning LLMs on Open-Ended Complex Tasks via Rubric-Based Incremental Training

تقدم الورقة البحثية إطار عمل ORBIT، وهو إطار تدريب تراكمي قائم على المعايير يستفيد من معايير مُولدة ديناميكيًا ومُكيّفة مع الحالات لضبط النماذج اللغوية الكبيرة بفعالية في الحوارات الطبية مفتوحة النهايات، محققًا أداءً هو الأفضل في فئته باستخدام حد أدنى من بيانات التدريب مع تجنب عيوب نمذجة المكافأة التقليدية.

Pengkai Wang, Pengwei Liu, Qi Zuo, Zhijie Sang, Congkai Xie, Hongxia Yang2026-05-28
🤖 AI

SynthTools: A Framework for Scaling Synthetic Tools for Agent Development

تقدم الورقة البحثية SynthTools، وهو إطار عمل يعتمد كلياً على النماذج اللغوية الكبيرة (LLM) يقوم تلقائياً بتوليد والتحقق من وتوسيع نطاق بيئات ومهام الأدوات الاصطناعية المتنوعة، مما يثبت أن تدريب الوكلاء على هذه البيانات الاصطناعية يحسن بشكل كبير أداءهم في استخدام الأدوات في الاختبارات المعيارية الواقعية.

Tommaso Castellani, Naimeng Ye, Daksh Mittal, Thomson Yen, Emmanouil Koukoumidis, William Zeng, Hongseok Namkoong2026-05-28
🤖 AI

Guaranteed Optimal Compositional Explanations for Neurons

تقدم هذه الورقة أول إطار نظري وخوارزمية تحسب تفسيرات تركيبية مثالية مضمونة للخلايا العصبية عبر فضاء الحالة بأكمله، مما يكشف أن 10-40% من نتائج البحث الشعاعي السابقة هي دون المستوى الأمثل، مع تقديم بديل أكثر مرونة وكفاءة.

Biagio La Rosa, Leilani H. Gilpin2026-05-28
📊 statistics

Optimal and Diffusion Transports in Machine Learning

يستكشف هذا الاستطلاع الروابط الرياضية بين طرق الانتشار والنقل الأمثل في تعلم الآلة، موضحاً كيف يوحد إطار عملهم اللاغرانجي المشترك لنمذجة التوزيعات الاحتمالية المتطورة زمنياً تطبيقات تتراوح من أخذ العينات في الذكاء الاصطناي التوليدي، وتحسين الشبكات العصبية، وصولاً إلى تحليل ديناميكيات النماذج اللغوية الكبيرة.

Gabriel Peyré2026-05-28
🤖 machine learning

Adapting, Fast and Slow: On Few-Shot Transportability of Compositions

تقدم هذه الورقة إطار عمل لقابلية النقل في سياق التعلم من عينات قليلة، والذي يحدد قابلية نقل الوحدات والدوائر لتمكين التنبؤ بأسلوب الصفر أو العينات القليلة عبر تركيب الآليات السببية المتعلمة من نطاقات المصدر، مع توفير ضمانات نظرية للخطأ وطريقة قائمة على التدرج للتكيف مع مهام الهدف بأدنى قدر من البيانات.

Kasra Jalaldoust, Elias Bareinboim2026-05-28
🤖 AI

On the Intrinsic Limits of Transformer Image Embeddings in Non-Solvable Spatial Reasoning

تجادل هذه الورقة بأن نماذج "محولات الرؤية" (Vision Transformers) تفشل جوهرياً في مهام الاستدلال المكاني غير القابلة للحل مثل الدوران الذهني، لأن بنيتها ذات العمق الثابت مقيدة حوسبياً بفئة التعقيد TC0\mathsf{TC^0}، وهي غير كافية لحل "مسألة الكلمة" (Word Problem) كاملة التعقيد من فئة NC1\mathsf{NC^1} والمطلوبة للحفاظ على البنية الجبرية للمجموعات غير القابلة للحل مثل SO(3)\mathrm{SO}(3).

Siyi Lyu, Quan Liu, Feng Yan2026-05-28
🔬 physics

Differential syntactic and semantic encoding in LLMs

تُثبت هذه الورقة أن المعلومات النحوية والدلالية في نموذج DeepSeek-V3 اللغوي الضخم مشفرة جزئياً بشكل خطي وموزعة بشكل متفاوت عبر الطبقات، كما يتضح من القدرة على فك الارتباط بين هذه الإشارات من خلال طرح مراكز التمثيلات المتوسطة.

Santiago Acevedo, Alessandro Laio, Marco Baroni2026-05-28
💬 NLP

On the Fallacy of Global Token Perplexity in Spoken Language Model Evaluation

تجادل هذه الورقة بأن مقياس "الحيرة العالمية للرموز" (global token perplexity) المعياري غير كافٍ لتقييم نماذج اللغة المنطوقة التوليدية بسبب الاختلافات الجوهرية في الوسائط، وتقترح مقاييس بديلة قائمة على الاحتمالية والتوليد ترتبط بشكل أفضل بالتقييمات البشرية وتكشف عن فجوة أداء أصغر بين النماذج والكلام البشري.

Chan-Jan Hsu, Liang-Hsuan Tseng, Yi-Cheng Lin, Yen-Chun Kuo, Ju-Chieh Chou, Kai-Wei Chang, Hung-yi Lee, Carlos Busso2026-05-28
🤖 AI

The Script is All You Need: An Agentic Framework for Long-Horizon Dialogue-to-Cinematic Video Generation

تقدم هذه الورقة إطار عمل وكيلِيًّا يتميز بـ ScripterAgent وDirectorAgent، مدعومًا بمعيار مرجعي ومقاييس تقييم جديدة، لسد الفجوة الدلالية بين الحوار وتوليد الفيديو السينمائي طويل الأمد من خلال ترجمة المفاهيم عالية المستوى إلى نصوص برمجية قابلة للتنفيذ تضمن التماسك السردي والأمانة للنص.

Chenyu Mu, Xin He, Qu Yang, Wanshun Chen, Jiadi Yao, Huang Liu, Zihao Yi, Bo Zhao, Xingyu Chen, Ruotian Ma, Fanghua Ye (…)2026-05-28
💬 NLP

The Grammar of Transformers: A Systematic Review of Interpretability Research on Syntactic Knowledge in Language Models

تخلص هذه المراجعة المنهجية لـ 337 دراسة إلى أن النماذج اللغوية القائمة على تقنية "ترانسفورمر" (Transformer) ترمز معرفة نحوية كبيرة، لا سيما في الظواهر الصورية واللغة الإنجليزية، ومع ذلك تواجه قيوداً في التعميم عبر اللغات وفي الواجهة بين النحو والدلالة، مع تسليط الض الضوء على الحاجة الماسة إلى المزيد من الأبحاث الآلية والمتنوعة لفهم عملياتها الحسابية الكامنة بشكل كامل.

Nora Graichen, Iria de-Dios-Flores, Gemma Boleda2026-05-28