💬 NLP

The Drill-Down and Fabricate Test (DDFT): A Protocol for Measuring Epistemic Robustness in Language Models

تقدم الورقة البحثية اختبار "التعمق والتصنيع" (DDFT)، وهو بروتوكول يثبت أن المتانة المعرفية للنموذج اللغوي —أي قدرته على الحفاظ على الدقة الواقعية تحت ضغط الضغط الدلالي والضغط العدائي— لا تعتمد على حجم النموذج أو بنيته، بل تعتمد بشكل حاسم على قدرات اكتشاف الأخطاء.

Rahul Baxi2026-04-07
💬 NLP

Parallel Universes, Parallel Languages: A Comprehensive Study on LLM-based Multilingual Counterfactual Example Generation

تقيم هذه الورقة البحثية تقييماً شاملاً لتوليد السيناريوهات المقابلة (counterfactual generation) متعددة اللغات القائمة على النماذج اللغوية الكبيرة، حيث وجدت أنه في حين تتفوق الأساليب القائمة على الترجمة على التوليد المباشر وتتشارك في أنماط تحرير مشتركة عبر اللغات، فإن أنواع الأخطاء المتأصلة والقيود النوعية تحد من مكاسب الأداء التي يمكن تحقيقها من خلال تعزيز البيانات المقابلة متعددة اللغات.

Qianli Wang, Van Bach Nguyen, Yihong Liu, Fedor Splitt, Nils Feldhus, Christin Seifert, Hinrich Schütze, Sebastian Mölle (…)2026-04-07
🤖 machine learning

Scaling DPPs for RAG: Density Meets Diversity

تقدم هذه الورقة ScalDPP، وهي آلية استرجاع قابلة للتوسع لأنظمة التوليد المعزز بالاسترجاع (RAG) تستفيد من عمليات النقطة المحدد (Deterministic Point Processes) وفقدان الهامش المتنوع (Diverse Margin Loss) المبتكر لتحسين كثافة السياق وتنوعه بشكل مشترك، مما يقلل من التكرار ويحسن تغطية الأدلة في توليد النماذج اللغوية الكبيرة (LLM).

Xun Sun, Baiheng Xie, Li Huang, Qiang Gao2026-04-07
💬 NLP

Robust LLM Performance Certification via Constrained Maximum Likelihood Estimation

تقترح هذه الورقة طريقة قوية وفعالة لتقدير معدلات فشل النماذج اللغوية الكبيرة من خلال الجمع بين مجموعة معايرة صغيرة مصنفة بشرياً، وتوسيمات واسعة النطاق من نماذج لغوية كبيرة تعمل كحكم، وقيود خاصة بالمجال ضمن إطار تقدير أقصى احتمالية مقيد، محققة دقة فائقة وتباينًا أقل مقارنة بالنماذج المرجعية الحالية مثل الاستدلال المدعوم بالتنبؤ.

Minghe Shen, Ananth Balashankar, Adam Fisch, David Madras, Miguel Rodrigues2026-04-07
💬 NLP

VIGIL: An Extensible System for Real-Time Detection and Mitigation of Cognitive Bias Triggers

تقدم هذه الورقة VIGIL، وهي أول إضافة متصفح مفتوحة المصدر مصممة لتوفير الكشف والحد من محفزات الانحياز المعرفي في المعلومات عبر الإنترنت من خلال ميزات مثل التحليل الموقعي، وإعادة الصياغة القابلة للعكس والمدعومة بالنماذج اللغوية الكبيرة، والاستدلال المرن من حيث الخصوصية.

Bo Kang, Sander Noels, Tijl De Bie2026-04-07
💬 NLP

On the First Computer Science Research Paper in an Indian Language and the Future of Science in Indian Languages

يسرد هذا البحث تجربة المؤلف في كتابة أول ورقة بحثية أصلية في علوم الحاسوب باللغة التيلوجو بالكامل، مفصلاً عملية إنشاء معجم تقني قائم على اللغة السنسكريتية وقالب XeLaTeX مخصص للتغلب على العوائق اللغوية وعوائق التنسيق الطباعي، مع طرح رؤية للنهوض بالكتابة العلمية عبر جميع لغات الهند (Indic languages).

Siddhartha Visveswara Jayanti2026-04-07
💬 NLP

Knowledge Packs: Zero-Token Knowledge Delivery via KV Cache Injection

تقدم هذه الورقة "حزم المعرفة" (Knowledge Packs)، وهي طريقة تحقق تسليمًا للمعرفة وتوجيهًا للسلوك بصفر توكن في المحولات السببية (causal transformers) عبر حقن مخازن (KV caches) محسوبة مسبقًا، بشرط الحفاظ على تنسيق قالب الدردشة الصارم لضمان التكافؤ التام مع تقنية (RAG) القياسية مع تمكين توفير في التوكنات يصل إلى 95%.

Andrey Pustovit2026-04-07
🔬 physics

Generative Chemical Language Models for Energetic Materials Discovery

تقدم هذه الورقة إطار عمل للتعلم بنقل المعرفة يستخدم نماذج لغوية جزيئية توليدية، تم تدريبها مسبقاً على بيانات كيميائية واسعة النطاق وضبطها بدقة باستخدام مجموعات بيانات للمواد الطاقية منتقاة، للتغلب على ندرة البيانات وتسريع اكتشاف المواد الطاقية من الجيل التالي من خلال ترميزات قائمة على الشظايا.

Andrew Salij, R. Seaton Ullberg, Megan C. Davis, Marc J. Cawkwell, Christopher J. Snyder, Cristina Garcia Cardona, Ivana (…)2026-04-07
💬 NLP

CoLA: Cross-Modal Low-rank Adaptation for Multimodal Downstream Tasks

تقدم هذه الورقة البحثية CoLA، وهو إطار عمل جديد للضبط الدقيق بكفاءة المعلمات يعزز التكيف متعدد الوسائط في البنيات ثنائية المسار عن طريق إضافة مسار مخصص بين الوسائط إلى تقنية LoRA القياسية، مما يتفوق على الأساليب الحالية في معايير الرؤية واللغة والسمع والبصر، مع تمكين أول ضبط دقيق بكفاءة المعلمات متعدد المهام لعمليات التأسيس البصري.

Wish Suharitdamrong, Tony Alex, Muhammad Awais, Sara Ahmed2026-04-07
💬 NLP

CresOWLve: Benchmarking Creative Problem-Solving Over Real-World Knowledge

تقدم الورقة البحثية CresOWLve، وهو معيار مرجعي جديد مصمم لتقييم النماذج اللغوية الكبيرة في مهام حل المشكلات الإبداعية القائمة على المعرفة بالواقع، كاشفةً أنه بينما تتفوق النماذج في استرجاع الحقائق، فإنها تعاني بشكل كبير في التكامل غير البديهي للمعلومات المطلوب للحلول الإبداعية.

Mete Ismayilzada, Renqing Cuomao, Daniil Yurshevich, Anna Sotnikova, Lonneke van der Plas, Antoine Bosselut2026-04-07