💬 NLP

Turning the TIDE: Cross-Architecture Distillation for Diffusion Large Language Models

تقدم الورقة البحثية TIDE، وهو أول إطار عمل للتقطير عبر البنيات لنماذج الانتشار اللغوية الكبيرة، والذي يستخدم ثلاثة مكونات مبتكرة لنقل المعرفة بنجاح من نماذج معلمة غير متجانسة بحجم 8 مليار و16 مليار معلمة إلى نموذج طالب بحجم 0.6 مليار، متفوقاً بشكل ملحوظ على النماذج المرجعية ذات التوليد الذاتي في اختبارات معيارية مثل توليد الكود.

Gongbo Zhang, Wen Wang, Ye Tian, Li Yuan2026-04-30
🔬 social physics

Universal statistical laws governing culinary design

تُظهر هذه الدراسة أن التقاليد الطهوية العالمية تلتزم بقوانين إحصائية عالمية تشبه تلك الموجودة في اللغة والأنظمة الرمزية الأخرى، مما يكشف أن هياكل الوصفات المعقدة تنبثق من عمليات توليدية بسيطة ومقيدة مثل إعادة الاستخدام التفضيلية والتعديل التدريجي.

Ganesh Bagler, Gopal Krishna Tewari, Aditya Raj Yadav, Akshat Singh, Pranay Bansal, Ujjval Dargar, Mansi Goel, Madhvi Ku (…)2026-04-30✓ Author reviewed
🤖 AI

Survey on reinforcement learning for language processing

تقدم هذه المقالة نظرة عامة على أحدث أساليب التعلم التعزيزي لمعالجة اللغات الطبيعية مع تركيز أساسي على الأنظمة القائمة على الحوار من خلال تحديد المشكلات ذات الصلة، وتحليل مدى ملاءمة هذه النهج وحدودها، ورسم اتجاهات البحث المستقبلية الواعدة.

Victor Uc-Cetina, Nicolas Navarro-Guerrero, Anabel Martin-Gonzalez, Cornelius Weber, Stefan Wermter2026-04-29
💬 NLP

TouchAI: Exploring human-AI perceptual alignment in touch through language model representations

تتقصى هذه الورقة التوافق الإدراكي بين النماذج اللغوية الكبيرة وتجارب اللمس البشرية من خلال مهمة "خمن نوع النسيج"، كاشفةً أنه في حين يوجد قدر من التوافق، إلا أنه يتفاوت بشكل كبير عبر أنواع المنسوجات المختلفة وغالباً ما يفشل في مطابقة التصورات الذاتية البشرية.

Shu Zhong, Elia Gatti, Youngjun Cho, Marianna Obrist2026-04-29
💬 NLP

Unconditional Truthfulness: Learning Unconditional Uncertainty of Large Language Models

تقترح هذه الورقة طريقة مبتكرة لتقدير عدم اليقين في النماذج اللغوية الكبيرة من خلال تدريب نموذج انحدار على خرائط الانتباه، واحتمالات الرموز، ودرجات عدم اليقين المحسوبة تكرارياً للكشف بفعالية عن الهلوسة وتحسين التوليد الانتقائي عبر مجموعات ونماذج متعددة.

Artem Vazhentsev, Ekaterina Fadeeva, Rui Xing, Gleb Kuzmin, Ivan Lazichny, Alexander Panchenko, Preslav Nakov, Timothy B (…)2026-04-29
💬 NLP

Token-Level Density-Based Uncertainty Quantification Methods for Eliciting Truthfulness of Large Language Models

تقدم هذه الورقة طريقة جديدة للتقدير الكمي لعدم اليقين تحت الإشراف لنماذج اللغات الكبيرة، والتي تعمل على تكييف مسافة ماهالانوبيس مع تمثيلات التوكن (token-level embeddings) عبر طبقات متعددة، مما يظهر دقة وقدرة على التعميم تتفوق على النهج الحالية في مهام استخلاص الحقيقة في كل من توليد التسلسلات والتحقق من الحقائق.

Artem Vazhentsev, Lyudmila Rvanova, Ivan Lazichny, Alexander Panchenko, Maxim Panov, Timothy Baldwin, Artem Shelmanov2026-04-29
💬 NLP

Large Language Models Are Effective Human Annotation Assistants, But Not Good Independent Annotators

بينما لا تُعد النماذج اللغوية الكبيرة موثوقة بما يكفي لتعمل كمُصنفات مستقلة لمهام كشف الأحداث، إلا أنها تعمل كمساعدات فعالة تقلل بشكل كبير من الوقت والجهد الذهني المطلوب من الخبراء البشريين لتنسيق مجموعات الأحداث وتصنيف المتغيرات.

Feng Gu, Zongxia Li, Carlos Rafael Colon, Benjamin Evans, Ishani Mondal, Jordan Lee Boyd-Graber2026-04-29
💬 NLP

Bridging the Linguistic Divide: A Survey on Leveraging Large Language Models for Machine Translation

تتفحص هذه الدراسة الاستقصائية بشكل شامل كيف تعمل النماذج اللغوية الكبيرة على تحويل الترجمة الآلية من خلال استراتيجيات متنوعة مثل التلقين، والضبط الدقيق، وتحسين التفضيلات، مع تركيز خاص على سيناريوهات الموارد المنخفضة، وسياقات مستوى المستند، وتحديات التقييم، لتؤطر في النهاية الترجمة الآلية القائمة على النماذج اللغوية الكبيرة كعملية تطور مدفوعة بجودة البيانات والمواءمة بدلاً من الحجم وحده.

Baban Gain, Dibyanayan Bandyopadhyay, Asif Ekbal, Trilok Nath Singh2026-04-29
💬 NLP

Images Amplify Misinformation Sharing in Vision-Language Models

تكشف هذه الدراسة أن نماذج الرؤية واللغة تظهر تحيزات شبيهة بالبشر من خلال زيادة ميلها بشكل كبير لإعادة مشاركة الأخبار الكاذبة عند وجود صور، وهي ثغرة تتفاقم أكثر بفعل سمات شخصية محددة وتتفاوت باختلاف بنيات النماذج.

Alice Plebe, Timothy Douglas, Diana Riazi, R. Maria del Rio-Chanona2026-04-29
💬 NLP

Cheaper, Better, Faster, Stronger: Robust Text-to-SQL without Chain-of-Thought or Fine-Tuning

تقدم هذه الورقة البحثية "N-rep"، وهي طريقة فعالة من حيث التكلفة لتحويل النص إلى SQL تحقق أداءً هو الأفضل في فئته على معيار BIRD بتكلفة تبلغ 0.039 دولار فقط لكل استعلام، وذلك عبر الاستفادة من تمثيلات متعددة للمخططات لضمان المتانة دون الاعتماد على استدلال "سلسلة الأفكار" المكلف أو الضبط الدقيق.

Yusuf Denizay Dönder, Derek Hommel, Andrea W Wen-Yi, David Mimno, Unso Eun Seo Jo2026-04-29