💬 NLP

Beyond Fine-Tuning: In-Context Learning and Chain-of-Thought for Reasoned Distractor Generation

تقترح هذه الورقة إطار عمل للتعلم في السياق معززاً بالتعليل، يستفيد من النماذج اللغوية الكبيرة مع الاسترجاع الدلالي غير الخاضع للإشراف لتوليد مشتتات (خيارات خاطئة) متطورة ومتوافقة مع التفكير لأسئلة الاختيار من متعدد، متفوقة بذلك على الأساليب الحالية القائمة على الضبط الدقيق عبر ستة معايير متنوعة.

Elaf Alhazmi, Quan Z. Sheng, Wei Emma Zhang2026-04-21
💬 NLP

Agents Explore but Agents Ignore: LLMs Lack Environmental Curiosity

تكشف هذه الورقة أن الوكلاء الحاليين القائمين على النماذج اللغوية الكبيرة يفتقرون إلى "الفضول البيئي"، حيث يفشلون بشكل متكرر في إدراك واستغلال المعلومات غير المتوقعة وذات الصلة بالمهمة التي يكتشفونها في بيئاتهم رغم معدلات الكشف العالية، وهو قصور مدفوع بعوامل مثل توفر الأدوات، والحوسبة، وبيانات التدريب التي تحد في نهاية المطئ من أدائهم العام.

Leon Engländer, Sophia Althammer, Ahmet Üstün, Matthias Gallé, Tom Sherborne2026-04-21
💬 NLP

Characterizing Model-Native Skills

تقترح هذه الورقة وتتحقق من صحة نهج "أصيل للنموذج" لتوصيف مهارات النماذج اللغوية عبر استخراج أساس متعامد قابل للتفسير مباشرة من تنشيطات مستوى التسلسل، مما يثبت أن هذا التمثيل الداخلي يتيح اختيار بيانات وتوجيهًا وقت الاستدلال أكثر فعالية بشكل ملحوظ لمهام الاستدلال والسلامة مقارنة بالتصنيفات التقليدية المحددة بشرياً.

Feiyang Kang, Mahavir Dabas, Myeongseob Ko, Ruoxi Jia2026-04-21
💬 NLP

Toward Reusability of AI Models Using Dynamic Updates of AI Documentation

تقترح هذه الورقة منهجية قائمة على البيانات والمجتمع لتحديث وثائق نماذج الذكاء الاصطناعي ديناميكيًا لتتماشى مع أفضل الممارسات المتطورة، مما يعالج الفجوة الزمنية في بطاقات النماذج ويعزز قابلية إعادة استخدام نماذج الذكاء الاصطناعي من خلال إثبات وجود ارتباط إيجابي بين جودة التوثيق ومقاييس التفاعل مع النماذج على منصة Hugging Face.

Peter Bajcsy, Walid Keyrouz2026-04-21
💬 NLP

Does Welsh media need a review? Detecting bias in Nation.Cymru's political reporting

تستخدم هذه الورقة مسار معالجة لغوية طبيعية مكون من مرحلتين لتحليل التقارير السياسية لموقع Nation.Cymru للفترة من 2022 إلى 2026، مما يكشف عن تباين دلالي ذي أهمية إحصائية يستهدف حزب "إصلاح المملكة المتحدة" (Reform UK) بشكل سلبي غير متناسب، بينما يؤطر حزب "بليد كومري" (Plaid Cymru) بشكل إيجابي، مما يقدم دليلاً تجريبياً لمراجعة أوسع للتحيز في وسائل الإعلام الويلزية.

Cai Parry-Jones2026-04-21
💬 NLP

ThreadSumm: Summarization of Nested Discourse Threads Using Tree of Thoughts

يقدم البحث إطار عمل ThreadSumm، وهو إطار عمل متعدد المراحل يعتمد على النماذج اللغوية الكبيرة (LLM)، والذي يستفيد من بحث "شجرة الأفكار" (Tree of Thoughts) عبر تمثيلات صريحة للجوانب والوحدات المحتوياتية لتوليد ملخصات ذات بنية منطقية وتغطية عالية لthreads النقاشات العميقة والمتداخلة.

Olubusayo Olabisi, Ekata Mitra, Ameeta Agrawal2026-04-21
💬 NLP

Measuring Distribution Shift in User Prompts and Its Effects on LLM Performance

تقدم هذه الورقة إطار عمل LENS لقياس التحولات الطبيعية في توزيع المطالبات في عمليات نشر النماذج اللغوية الكبيرة (LLM) في العالم الحقيقي، كاشفةً أن حتى التحولات المتوسطة في سلوك المستخدم، أو الوقت، أو الجغرافيا يمكن أن تسبب تدهوراً حاداً في الأداء (بمتوسط فقد قدره 73%)، ومسلطةً الضوء على الحاجة الماسة للمراقبة القائمة على البيانات لضمان موثوقية النموذج عبر المجموعات السكانية المتطورة.

Parker Seegmiller, Sarah Masud Preum2026-04-21
💬 NLP

Video-Robin: Autoregressive Diffusion Planning for Intent-Grounded Video-to-Music Generation

يُعد Video-Robin نموذجاً مبتكراً لتوليد الموس see من النصوص والتحويل من الفيديو إلى الموسيقى، يجمع بين التخطيط ذاتي الانحدار والتركيب القائم على الانتشار لإنتاج موسيقى عالية الدقة ومتوافقة دلالياً مع قدرة تحكم دقيقة وسرعة استنتاج أكبر بكثير من الأساليب الرائدة.

Vaibhavi Lokegaonkar, Aryan Vijay Bhosale, Vishnu Raj, Gouthaman KV, Ramani Duraiswami, Lie Lu, Sreyan Ghosh, Dinesh Man (…)2026-04-21
🤖 machine learning

ATLAS: Constitution-Conditioned Latent Geometry and Redistribution Across Language Models and Neural Perturbation Data

تقدم الورقة البحثية إطار عمل ATLAS، وهو إطار عمل يعتمد على الهندسة أولاً، يوضح أن مرحلة ما بعد التدريب المشروطة بالدستور تستحث بنية هندسية كامنة قابلة للاسترداد وتستمر عبر مختلف النماذج اللغوية والركائز العصبية رغم التحولات في الإحداثيات المحلية والتعبير السلوكي.

Gareth Seneque, Lap-Hang Ho, Nafise Erfanian Saeedi, Jeffrey Molendijk, Tim Elson2026-04-21
💬 NLP

Towards Intelligent Legal Document Analysis: CNN-Driven Classification of Case Law Texts

تقترح هذه الورقة إطار عمل يعتمد على الشبكات العصبية الالتفافية (CNN) يتميز بخفته ودقته العالية، حيث يجمع بين التجذير (lemmatization)، وتضمينات FastText، والالتفاف متعدد النوى لتحقيق تصنيف فائق لعمليات الاستشهاد والمعالجة في الوثائق القانونية، متفوقاً بذلك على نماذج المحولات (transformer) الثقيلة مثل BERT في كل من الدقة وسرعة الاستدلال.

Moinul Hossain, Sourav Rabi Das, Zikrul Shariar Ayon, Sadia Afrin Promi, Ahnaf Atef Choudhury, Shakila Rahman, Jia Uddin2026-04-21