💬 NLP

How AI Systems Think About Education: Analyzing Latent Preference Patterns in Large Language Models

تقدم هذه الورقة أول قياس منهجي للمواءمة التعليمية في النماذج اللغوية الكبيرة، كاشفةً أن GPT-5.1 يُظهر أنماط تفضيل متماسكة للغاية تتماشى مع المبادئ الإنسانية في مجالات الإجماع الخبير، بينما يتبنى مواقف متميزة وغير محايدة في المجالات التي يحمل فيها الخبراء البشريون أنفسهم آراءً معيارية متنازعاً عليها.

Daniel Autenrieth2026-03-24
🤖 machine learning

CLT-Forge: A Scalable Library for Cross-Layer Transcoders and Attribution Graphs

تقدم هذه الورقة البحثية CLT-Forge، وهي مكتبة مفتوحة المصدر تتيح التدريب الموزع القابل للتوسع والتحليل التفسيري الشامل لـ "المحولين عبر الطبقات" (Cross-Layer Transcoders) لمعالجة تحديات التكرار والتعقيد في التفسير الآلي للنماذج اللغوية الكبيرة.

Florent Draye, Abir Harrasse, Vedant Palit, Tung-Yu Wu, Jiarui Liu, Punya Syon Pandey, Roderick Wu, Terry Jingchen Zhang (…)2026-03-24
💬 NLP

Left Behind: Cross-Lingual Transfer as a Bridge for Low-Resource Languages in Large Language Models

تكشف هذه الورقة أن النماذج اللغوية الكبيرة تظهر فجوة دقة كبيرة في اللغات ذات الموارد المنخفضة مثل الكازاخية والمغولية مقارنة بالإنجليزية، مما يثبت أن التلقين بنقل المعرفة عبر اللغات يحسن الأداء فقط للنماذج ثنائية اللغة بينما يفشل في إفادة النماذج المهيمنة باللغة الإنجليزية.

Abdul-Salem Beibitkhan2026-03-24
💬 NLP

Reading Between the Lines: How Electronic Nonverbal Cues shape Emotion Decoding

من خلال تصنيف موحد، وتجربة مسحية سببية، ومناقشات مجموعات التركيز، تُثبت هذه الورقة أن الإشارات غير اللفظية الإلكترونية (eNVCs) تعزز بشكل كبير دقة فك التشفير العاطفي وتقلل من الغموض في التواصل القائم على النصوص، بينما تكشف أيضاً عن حدودها في سياقات مثل السخرية وتوفر مجموعة أدوات جديدة مفتوحة المصدر للكشف الآلي عنها.

Taara Kumar, Kokil Jaidka2026-03-24
🤖 AI

LongCat-Flash-Prover: Advancing Native Formal Reasoning via Agentic Tool-Integrated Reinforcement Learning

تقدم الورقة البحثية نموذج LongCat-Flash-Prover، وهو نموذج "خليط من الخبراء" (Mixture-of-Experts) مفتوح المصدر بـ 560 مليار معلمة، يحقق أداءً هو الأفضل في فئته في مجالات الصياغة الآلية لـ Lean4 وإثبات النظريات عبر تفكيك مهام الاستدلال إلى قدرات متخصصة وتدريبها من خلال خوارزمية "تحسين سياسة أخذ العينات الهرمي للأهمية" (Hierarchical Importance Sampling Policy Optimization) المبتكرة ضمن إطار عمل "التعلم المعزز المتكامل مع الأدوات الوكيلية" (Agentic Tool-Integrated Reinforcement Learning).

Jianing Wang, Jianfei Zhang, Qi Guo, Linsen Guo, Rumei Li, Chao Zhang, Chong Peng, Cunguang Wang, Dengchang Zhao, Jiaron (…)2026-03-24
⚡ electrical engineering

SqueezeComposer: Temporal Speed-up is A Simple Trick for Long-form Music Composing

تقدم الورقة البحثية SqueezeComposer، وهو إطار عمل يتيح توليد موسيقى طويلة المدى بكفاءة وجودة عالية من خلال الاستفادة من حيلة بسيطة لتسريع الزمن لتقليل المتطلبات الحسابية أثناء عملية التوليد قبل استعادة الصوت إلى سرعته الأصلية.

Jianyi Chen, Rongxiu Zhong, Shilei Zhang, Kun Qian, Jinglei Liu, Yike Guo, Wei Xue2026-03-24
🤖 machine learning

Mixture of Chapters: Scaling Learnt Memory in Transformers

تقدم هذه الورقة البحثية "خليط الفصول" (Mixture of Chapters)، وهي بنية مبتكرة ترفع سعة ذاكرة المحولات (transformer) إلى 262 ألف توكن باستخدام بنوك ذاكرة متفرقة قابلة للتعلم وتوجيه قائم على الفصول، مما يظهر أداءً فائقاً وتقليلاً في النسيان الكارثي مقارنة بنماذج الـ iso-FLOP القياسية.

Tasmay Pankaj Tibrewal, Pritish Saha, Ankit Meda, Kunal Singh, Pradeep Moturi2026-03-24
💬 NLP

Entropy Alone is Insufficient for Safe Selective Prediction in LLMs

تُثبت هذه الورقة أن التكميم القائم على الإنتروبيا لعدم اليقين وحده غير كافٍ للتنبؤ الانتقائي الآمن في النماذج اللغوية الكبيرة بسبب أوضاع الفشل المعتمدة على النموذج، وتقترح نهجاً مشتركاً مع إشارة مسبار الصحة التي تُحسن بشكل كبير مقايضات المخاطر والتغطية والمعايرة عبر مختلف المعايير وعائلات النماذج.

Edward Phillips, Fredrik K. Gustafsson, Sean Wu, Anshul Thakur, David A. Clifton2026-03-24
💬 NLP

Context Selection for Hypothesis and Statistical Evidence Extraction from Full-Text Scientific Articles

تتقصى هذه الورقة تحديات استخراج الفرضيات والأدلة الإحصائية من المقالات العلمية كاملة النص، مظهرةً أنه في حين أن اختيار السياق المستهدف يحسن استخراج الفرضيات بشكل كبير، فإن استخراج الأدلة الإحصائية يظل صعباً بسبب القيود المتأصلة في التعامل مع العبارات الهجينة الرقمية-النصية بدلاً من مجرد إخفاقات الاسترجاع.

Sai Koneru, Jian Wu, Sarah Rajtmajer2026-03-24
💬 NLP

Graph Fusion Across Languages using Large Language Models

تقترح هذه الورقة إطار عمل مبتكر يستفيد من قدرات نماذج اللغات الكبيرة في الاستدلال السياقي والقدرات متعددة اللغات لإجراء دمج الرسوم البيانية عبر اللغات عن طريق تحويل ثلاثيات الرسوم البيانية إلى تسلسلات لغوية طبيعية، مما يحل بفعالية عدم التجانس الدلالي ويمكّن التجميع القابل للتوسع لرسوم بيانية معرفية متباينة.

Kaung Myat Kyaw, Khush Agarwal, Jonathan Chan2026-03-24