💬 NLP

The Missing Piece in Pre-trained Model Evaluation: Reward-Guided Decoding Unlocks Task-Oriented Behavior Without Parameter Updates

تقدم الورقة البحثية فك التشفير القائم على الطاقة (EBD)، وهو إطار عمل موجه بالمكافأة ولا يتطلب تدريباً، يوجه النماذج اللغوية مسبقة التدريب والمجمدة نحو سلوكيات موجهة للمهام ويحسن أداءها في الاختبارات المعيارية بشكل كبير دون الحاجة إلى تحديثات للمعلمات أو عمليات تدريب لاحقة مكلفة.

Shaobo Wang, Guo Chen, Ziyue Wang, Zhengyang Tang, Qingyang Liu, Xingzhang Ren, Dayiheng Liu, Linfeng Zhang2026-05-28
💬 NLP

Beyond pass@k: Redundancy-Aware RLVR for Multi-Sample Code Generation

تحدد هذه الورقة أن التعلم المعزز القائم على التحقق والمركز على الصحة القياسي (RLVR) يؤدي إلى توليد أكواد برمجية مكررة، وتقترح نهجًا للتعلم المعزز القائم على التحقق والمركز على الصحة ويكون واعيًا بالتكرار باستخدام مكافآت مضادة للتكرار قائمة على JPlag، مما يحسن بشكل كبير أداء توليد الأكواد البرمجية ضمن الميزانية المحدودة من خلال الحفاظ على حلول مرشحة متنوعة.

Le Bronnec Florian, Alexandre Verine, Rio Yokota, Benjamin Negrevergne2026-05-28
💬 NLP

VCap: Hypergeometric Rewards for Weak-to-Strong Visual Captioning

تقترح الورقة البحثية VCap، وهي آلية مكافأة جديدة تعتمد على نظام "الشاهد-المُحكّم" تستفيد من دقة بمستوى التوزيع الهيبرجيومتري للتحقق من الاتساق الواقعي بين التعليقات المرجعية والمولدة، مما يتيح تعميماً من الضعيف إلى القوي في التعلم المعزز يسمح لنموذج بحجم 8 مليار بارامتر بالتفوق على أنظمة التعليق البصري الرائدة.

Xingyu Lu, Jinpeng Wang, Yi-Fan Zhang, Yankai Yang, Yancheng Long, Yiyang Fan, Xuanyu Zheng, Haonan Fan, Kaiyu Jiang, Ti (…)2026-05-28
🤖 AI

MemCog: From Memory-as-Tool to Memory-as-Cognition in Conversational Agents

تقدم الورقة البحثية إطار عمل MemCog، وهو إطار "الذاكرة كإدراك" الذي يستبدل الاسترجاع السلبي أحادي الخطوة بنظام نشط متكامل مع الاستنتاج، يتميز برسوم بيانية للذاكرة قابلة للتنقل وبروتوكولات استكشاف استباقية، محققاً أداءً هو الأفضل في فئته (SOTA) في كل من الأسئلة والأجوبة السلبية ومعيار الذاكرة الاستباقية المقترح حديثاً.

Zihan Li, Xingyu Fan, Feifei Li, Wenhui Que2026-05-28
💬 NLP

Challenges in Explaining Pretrained Clinical Text Classifiers

تُثبت هذه الورقة أن طرق التفسير اللاحقة الشائعة مثل LIME وSHAP تفشل في تقديم رؤى موثوقة لمصنفات النصوص السريرية من خلال تسليط الضوء على ميلها إلى المبالغة في التأكيد على الرموز غير المعلوماتية، وإنتاج إسنادات غير مستقرة، وتقديم تنبؤات عالية الثقة لمدخلات غير متماسكة، مما يؤكد الحاجة الملحة لاستراتيجيات تفسير قوية وذات مغزى سريري.

Kristian Miok, Matej Klemen, Blaz Škrlj, Marko Robnik Šikonja2026-05-28
💬 NLP

PromptEmbedder:: Efficient and Transferable Text Embedding via Dual-LLM Soft Prompting

يقدم PromptEmbedder إطار عمل جديداً يعتمد على نموذج لغوي كبير مزدوج (dual-LLM) يعمل على فصل معرفة التضمين عن أوزان النموذج الأساسي من خلال التلقين الناعم (soft prompting)، مما يتيح تكييفاً فعالاً لتضمين النصوص غير مرتبط ببنية معمارية محددة ويحقق أداءً يضاهي تقنية LoRA مع تقليل استهلاك الذاكرة ووقت التدريب بشكل كبير.

Yu-Che Tsai, Kuan-Yu Chen, Yuan-Hao Chen, Yu-Han Chang, Ching-Yu Tsai, Yu-Hsiang Chuang, Shou-De Lin2026-05-28
💬 NLP

SilentRetrieval: Hijacking Retrieval-Augmented Generation via Semantically-Preserving Adversarial Data Poisoning

تقدم الورقة البحثية SilentRetrieval، وهو هجوم تسميم بيانات ثنائي المراحل يختطف أنظمة التوليد المعزز بالاسترجاع (RAG) عبر حقن مستندات عدائية مصاغة بطلاقة تحافظ على تصنيفات استرجاع عالية وتنجح في تلاعب مخرجات النماذج اللغوية الكبيرة مع التهرب من الكشف عبر الحفاظ على التماسك الدلالي.

Jiachen Qian2026-05-28
💬 NLP

SMILE-Next: Teaching Large Language Models to Detect, Classify, and Reason about Laughter

تقدم هذه الورقة SMILE-Next، وهي مجموعة بيانات شاملة للضحك في العالم الحقيقي، وتقترح إطار عمل لنموذج لغوي كبير متخصص يتميز بآلية "التعليم الذاتي الخاص بالضحك" (Laughter-specific Self-Instruct) وآلية "خليط من خبراء الضحك" (Mixture-of-Laugh-Experts - MoLE) لتحسين اكتشاف وتصنيف واستدلال إشارات الضحك الاجتماعي المعقدة بشكل كبير.

Lee Jung-Mok, Kim Sung-Bin, Joohyun Chang, Lee Hyun, Tae-Hyun Oh2026-05-28
💬 NLP

MIRAGE: Context-Aware Prompt Injection against Mobile GUI Agents via User-Generated Content

تقدم الورقة البحثية MIRAGE، وهو مسار هجوم مدرك للسياق يقوم بحقن مطالبات عدائية في المحتوى الذي ينشئه المستخدم داخل لقطات شاشة واجهة مستخدم الهاتف المحمول لخداع وكلاء النماذج اللغوية الرؤية، مما يثبت أن جميع الوكلاء الخمسة الذين تم تقييمهم عرضة لهجمات واقعية لا يمكن تمييزها بصرياً بنسب نجاح تتراوح بين 23% و30%.

Ruoqi Guo, Yi Liu, Gelei Deng, Yiheng Xiong, Yuekang Li, Ying Zhang, Leo Yu Zhang, Lida Zhao, Ji Jie, Yuxiao Lu2026-05-28
💬 NLP

LegalGraphRAG: Multi-Agent Graph Retrieval-Augmented Generation for Reliable Legal Reasoning

يُعد LegalGraphRAG إطار عمل متعدد الوكلاء يعزز الاستدلال القانوني الموثوق من خلال توظيف رسم بياني قانوني هرمي لإدارة المعرفة غير المتجانسة ونظام وكلاء تعاوني (باحث، مدقق، ومُحكّم) لضمان أحكام شفافة وقائمة على الأدلة، محققاً أداءً هو الأفضل في فئته مقارنة بالنماذج المرجعية الحالية لتقنية GraphRAG.

Zerui Chen, Qinggang Zhang, Zhishang Xiang, Zhimin Wei, Linfeng Gao, Xiao Huang, Zhihong Zhang, Jinsong Su2026-05-28