💬 NLP

LLMpedia: A Transparent Framework to Materialize an LLM's Encyclopedic Knowledge at Scale

يكشف مشروع LLMpedia أن المعرفة الموسوعية الحقيقية للنماذج اللغوية الكبيرة أقل بكثير مما تشير إليه المعايير القياسية، وذلك من خلال إنشاء موسوعة مفتوحة بالكامل وخالية من الاسترجاع مكونة من مليون مقال تكشف عن فجوات جوهرية في الواقعية وتحيزات موضوعية عبر عائلات النماذج المختلفة.

Muhammed Saeed, Simon Razniewski2026-03-26
🤖 machine learning

The Alignment Tax: Response Homogenization in Aligned LLMs and Its Implications for Uncertainty Estimation

تحدد هذه الورقة "تجانس الاستجابة" كضريبة محاذاة كبيرة في النماذج اللغوية المدربة باستخدام التعلم التعزيزي من التغذية الراجعة البشرية (RLHF) تجعل تقدير عدم اليقين القائم على أخذ العينات غير فعال، مبرهنةً أن إنتروبيا الرمز (token entropy) تظل إشارة قوية ومقترحةً استراتيجية تتابع منخفضة التكلفة لتحسين دقة التنبؤ الانتقائي.

Mingyi Liu2026-03-26
💬 NLP

A visual observation on the geometry of UMAP projections of the difference vectors of antonym and synonym word pair embeddings

يُبلغ هذا البحث عن نمط "دوامي" مثير للاهتمام لوحظ في الإسقاطات الهندسية لمتجهات الفرق بين تمثيلات أزواج الكلمات المترادفة والمتضادة عبر نماذج محولة (transformer) متنوعة، مما يسلط الضوء على البنى المكانية المعقدة التي تكمن وراء التضاد الدلالي.

Rami Luisto2026-03-26
💬 NLP

Variation is the Norm: Embracing Sociolinguistics in NLP

تقترح هذه الورقة إطار عمل يدمج المبادئ اللغوية الاجتماعية في معالجة اللغات الطبيعية للتعامل مع التباين اللغوي كسمة ذات دلالة بدلاً من كونه ضجيجاً، وتثبت من خلال دراسة حالة للغة اللوكسمبورغية أن مراعاة التباين الإملائي صراحةً أثناء عملية الضبط الدقيق يحسن بشكل كبير من متانة النموذج وأدائه.

Anne-Marie Lutgen, Alistair Plum, Verena Blaschke, Barbara Plank, Christoph Purschke2026-03-26
💬 NLP

Optimizing Multilingual LLMs via Federated Learning: A Study of Client Language Composition

تستقصي هذه الورقة البحثية تأثير تكوين لغة العميل على التعلم الاتحادي متعدد اللغات للنماذج اللغوية الكبيرة، مبرهنةً على أن زيادة تعدد اللغات داخل العميل الواحد تؤدي إلى نماذج عالمية أكثر عدلاً وفعالية، لا سيالما بالنسبة للغات ذات الموارد المنخفضة، مع تقديم آلية مبتكرة للتوقف المبكر الديناميكي المحلي لتعزيز كفاءة التدريب.

Aleix Sant, Jordi Luque, Carlos Escolano2026-03-26
💬 NLP

Semantic Centroids and Hierarchical Density-Based Clustering for Cross-Document Software Coreference Resolution

تقدم هذه الورقة إطار عمل هجين لحل مرجع البرمجيات عبر المستندات يدمج التضمينات الدلالية، والبحث في قواعد المعرفة عبر FAISS، وتجميع HDBSCAN لتحقيق درجات F1 عالية عبر مهام فرعية متعددة للمهمة المشتركة.

Julia Matela, Frank Krüger2026-03-26
⚛️ quantum physics

SpinGQE: A Generative Quantum Eigensolver for Spin Hamiltonians

تقدم هذه الورقة SpinGQE، وهو حل طيفي كمي توليدي يستخدم فك تشفير قائم على المحولات لتعلم التوزيعات عبر الدوائر الكمية لإيجاد الحالات الأرضية لهاملتونيات السبين، مما يظهر تقارباً ناجحاً في نموذج هيزنبرج رباعي الكيوبت كبديل قابل للتوسع للطرق التباينية التقليدية.

Alexander Holden, Moinul Hossain Rahat, Nii Osae Osae Dade2026-03-26
💬 NLP

GameplayQA: A Benchmarking Framework for Decision-Dense POV-Synced Multi-Video Understanding of 3D Virtual Agents

تقدم الورقة البحثية GameplayQA، وهو إطار عمل مرجعي مبتكر يقيم قدرة النماذج اللغوية الكبيرة متعددة الوسائط على فهم واستنتاج أسلوب اللعب ثلاثي الأبعاد كثيف المنظور الأول ومتعدد الوكلاء من خلال تعليقات توضيحية ثلاثية عالية التردد، مما يكشف عن فجوات كبيرة في قدرات النماذج الحالية في الربط الزمني، وعزو الوكلاء، واتخاذ القرار مقارنة بالأداء البشري.

Yunzhe Wang, Runhui Xu, Kexin Zheng, Tianyi Zhang, Jayavibhav Niranjan Kogundi, Soham Hans, Volkan Ustun2026-03-26
💬 NLP

Improving Lean4 Autoformalization via Cycle Consistency Fine-tuning

تُثبت هذه الورقة أن الضبط الدقيق لنموذج Qwen3.5-2B باستخدام التعلم التعزيزي مع مكافأة اتساق الدورة يتفوق بشكل كبير على متغيرات الضبط الدقيق الخاضع للإشراف في عملية الصياغة الرسمية التلقائية للغة Lean4 على كل من FineLeanCorpus وPutnamBench، بينما لا يوفر التعلم المنهجي أي فائدة ملموسة.

Arsen Shebzukhov2026-03-26
💬 NLP

Towards Reward Modeling for AI Tutors in Math Mistake Remediation

تتناول هذه الورقة البحثية تحدي تقييم معلمي الرياضيات القائمين على الذكاء الاصطناعي من خلال اشتقاق تسلسل هرمي تربوي من التفضيلات البشرية، وتوليف أزواج استجابة تباينية، وتدريب نموذج مكافأة "برادلي-تيري" مدمج بحجم 0.5 مليار معلمة يحقق دقة زوجية تبلغ 0.74 في اختبارات التفضيل البشري، متفوقاً بذلك على النماذج الأكبر ذات الأغراض العامة.

Kseniia Petukhova, Ekaterina Kochmar2026-03-26