💬 NLP

A Multi-View Media Profiling Suite: Resources, Evaluation, and Analysis

تقدم هذه الورقة مجموعة بيانات MBFC-2025 ومجموعة أدوات لتوصيف الوسائط متعددة الرؤى تستفيد من التمثيلات المتنوعة واستراتيجيات الدمج لتحقيق نتائج رائدة في اكتشاف الانحياز السياسي والموثوقية عبر المنافذ الإخبارية.

Muhammad Arslan Manzoor, Dilshod Azizov, Daniil Orel, Umer Siddique, Zain Muhammad Mujahid, Yufang Hou, Preslav Nakov2026-05-05
💬 NLP

LLM Output Detectability and Task Performance Can be Jointly Optimized

تقدم الورقة البحثية إطار عمل PUPPET، وهو إطار للتعلم المعزز يعمل على ضبط النماذج اللغوية الكبيرة لتعزيز قابليتها للكشف عبر إشارات تشبه العلامات المائية وفي الوقت ذاته تحسين أدائها في المهام اللاحقة، متفوقاً بذلك على طرق العلامات المائية التقليدية مع الحفاظ على المتانة تجاه الهجمات والكفاءة في التدريب.

Koshiro Saito, Ryuto Koike, Masahiro Kaneko, Naoaki Okazaki2026-05-05
💬 NLP

On Stable Long-Form Generation: Benchmarking and Mitigating Length Volatility

تتناول هذه الورقة البحثية التقلب الكبير في الطول عند التوليد طويل النص من خلال تقديم معيار VOLBench لقياس هذه المشكلة، وتحديد أسبابها الداخلية القائمة على آلية الانتباه، واقتراح استراتيجية فك التشفير GLoBo، وهي استراتيجية لا تتطلب تدريباً تعمل على تحسين دقة واستقرار الطول بشكل جوهري مع الحفاظ على جودة التوليد.

Zhitao He, Haolin Yang, Rui Min, Zeyu Qin, Yi R. Fung2026-05-05
💬 NLP

Focus on the Core: Empowering Diffusion Large Language Models by Self-Contrast

تقدم الورقة البحثية FoCore، وهي استراتيجية فك تشفير خالية من التدريب لنماذج اللغات الكبيرة القائمة على الانتشار، والتي تستفيد من التقارب المبكر للرموز ذات كثافة المعلومات العالية من خلال التباين الذاتي لتحسين جودة التوليد وتسريع سرعة الاستنتاج في آن واحد.

Jinyuan Feng, Xin Yu, Yiqun Chen, Xiaochi Wei, Yan Gao, Yi Wu, Yao Hu, Zhiqiang Pu2026-05-05
💬 NLP

MTA: Multi-Granular Trajectory Alignment for Large Language Model Distillation

تقترح الورقة البحثية محاذاة المسارات متعددة الحبيبات (MTA)، وهو إطار عمل لتقطير المعرفة يعمل على محاذاة تمثيلات المعلم والطالب عبر مسارات التحول لكل طبقة باستخدام مطابقة تكيفية على مستوى الكلمات والعبارات لالتقاط تطور الدلالات التركيبية بشكل أفضل وتحسين ضغط النماذج اللغوية الكبيرة.

Pham Khanh Chi, Quoc Phong Dao, Thuat Nguyen, Linh Ngo Van, Trung Le, Thanh Hong Nguyen2026-05-05
💬 NLP

A framework for analyzing concept representations in neural models

تقدم هذه الورقة إطارًا موحدًا لتحليل تمثيلات المفاهيم العصبية على محوري الاحتواء وفك التشابك، كاشفةً أن اختيار طريقة التقدير يؤثر بشكل كبير على هذه الخصائص، ومسلطةً الض الضوء على تحديات محددة في تعميم طرق محو المفاهيم وعزل معلومات المتحدث في نماذج الكلام.

Burin Naowarat, Hao Tang, Sharon Goldwater2026-05-05
💬 NLP

MemORAI: Memory Organization and Retrieval via Adaptive Graph Intelligence for LLM Conversational Agents

يُعد MEMORAI إطار عمل مبتكر يعزز المحادثات طويلة الأمد المخصصة مع النماذج اللغوية الكبيرة من خلال دمج التصفية الانتقائية للذاكرة، والرسوم البيانية متعددة العلاقات الغنية بالمصدر، والاسترجاع الفرعي المتكيف مع الاستعلام للتغلب على قيود أنظمة الذاكرة الحالية.

Hung Pham Van, Nguyen Manh Hieu, Khang Pham Tran Tuan, Nam Le Hai, Linh Ngo Van, Nguyen Thi Ngoc Diep, Trung Le2026-05-05
💬 NLP

Verbal-R3: Verbal Reranker as the Missing Bridge between Retrieval and Reasoning

تقدم هذه الورقة البحثية Verbal-R3، وهو إطار عمل جديد للبحث المعزز بالتوليد (RAG) القائم على الوكلاء، والذي يجسّر الفجوة بين الاسترجاع والاستدلال عبر توظيف "إعادة ترتيب لفظي" (Verbal Reranker) لتوليد سرديات تحليلية (تعليقات لفظية) توضح صراحةً الروابط المنطقية بين الاستعلامات والسياقات المسترجعة، محققاً بذلك أداءً هو الأفضل في فئته على معايير الإجابة على الأسئلة المعقدة.

Sangkwon Park, Donghun Kang, Jisoo Mok, Sungroh Yoon2026-05-05
💬 NLP

Medmarks: A Comprehensive Open-Source LLM Benchmark Suite for Medical Tasks

تقدم هذه الورقة Medmarks، وهي مجموعة معيارية شاملة ومفتوحة المصدر تتكون من 30 مهمة طبية متنوعة و61 نموذجاً تم تقييمها، والتي تكشف أن نماذج الاستدلال الرائدة تتفوق على غيرها في الدقة وكفاءة الرموز (token efficiency) مع تسليط الض الضوء على عرضة النماذج الأصغر لـتحيز ترتيب الإجابة.

Benjamin Warner, Ratna Sagari Grandhi, Max Kieffer, Aymane Ouraq, Saurav Panigrahi, Geetu Ambwani, Kunal Bagga, Nikhil K (…)2026-05-05
💬 NLP

Hallucinations Undermine Trust; Metacognition is a Way Forward

تجادل الورقة البحثية بأن تحسين موثوقية الذكاء الاصطناي التوليدي يتطلب الانتقال من مجرد توسيع المعرفة الواقعية إلى تعزيز القدرات وراء المعرفية، وتحديداً عبر تعليم النماذج كيفية التعبير عن "عدم اليقين المخلص" للتمييز بين الحقائق المعروفة والأخطاء الواثقة.

Gal Yona, Mor Geva, Yossi Matias2026-05-05