💬 NLP

DART: Mitigating Harm Drift in Difference-Aware LLMs via Distill-Audit-Repair Training

تقدم الورقة البحثية إطار عمل التدريب DART، وهو إطار (تقطير-تدقيق-إصلاح) يخفف من حدة "انحراف الضرر" — حيث تصبح النماذج المضبوطة للسلامة أكثر ضرراً مع تحسنها في التعرف على الاختلافات الديموغرافية — وذلك عبر تقطير الاستدلال، والتدقيق بحثاً عن المخرجات الضارة، وإصلاحها، مما يعزز الدقة بشكل كبير في المهام الواعية بالاختلافات مع تقليل كل من المحتوى الضار والرفض غير المبرر.

Ziwen Pan, Zihan Liang, Jad Kabbara, Ali Emami2026-04-21
💬 NLP

A Community-Based Approach for Stance Distribution and Argument Organization

تقدم هذه الورقة نظاماً قائماً على الرسوم البيانية وغير خاضع للإشراف، يقوم بتنظيم أحجام كبيرة من المحتوى الجدلي عبر الإنترنت إلى مجتمعات قابلة للتفسير من خلال تحليل العلاقات الدلالية والهيكلية، مما يساعد المستخدمين على التنقل واستيعاب المناظرات الاجتماعية والسياسية المعقدة دون الحاجة إلى بيانات تدريبية.

Rudra Ranajee Saha, Laks V. S. Lakshmanan, Raymond T. Ng2026-04-21
💻 computer science

PRISM: Probing Reasoning, Instruction, and Source Memory in LLM Hallucinations

تقدم الورقة البحثية PRISM، وهو معيار شامل يعيد صياغة تقييم الهلوسة في النماذج اللغوية الكبيرة كمسألة تشخيصية عبر تفكيك الأخطاء إلى أربعة أبعاد محددة عبر ثلاث مراحل توليد، مما يكشف عن مقايضات حرجة في أداء النماذج ويوفر إطارًا لتطوير أنظمة ذكاء اصطناعي أكثر موثوقية.

Yuhe Wu, Guangyu Wang, Yuran Chen, Jiatong Zhang, Yutong Zhang, Yujie Chen, Jiaming Shang, Guang Zhang, Zhuang Liu2026-04-21
💻 computer science

Freshness-Aware Prioritized Experience Replay for LLM/VLM Reinforcement Learning

تقدم هذه الورقة البحثية "إعادة تشغيل الخبرة ذات الأولوية المدركة للحداثة" (Freshness-Aware Priorized Experience Replay)، وهي طريقة مبتكرة تخفف من حدة تقادم الأولوية في النماذج اللغوية الكبيرة والنماذج اللغوية البصرية عبر دمج عامل اضمحلال أسي للعمر، مما يحسن بشكل كبير من كفاءة العينات والأداء في المهام الوكيلية والتحليلية المعقدة مقارنة بالنهج التقليدية المعتمدة على السياسة الحالية.

Weiyu Ma, Yongcheng Zeng, Yan Song, Xinyu Cui, Jian Zhao, Xuhui Liu, Mohamed Elhoseiny2026-04-21
💬 NLP

SPS: Steering Probability Squeezing for Better Exploration in Reinforcement Learning for Large Language Models

تقترح هذه الورقة "ضغط احتمالية التوجيه" (SPS)، وهو نموذج تدريب مبتكر يدمج التعلم التعزيزي مع التعلم التعزيزي العكسي لمواجهة تركيز الكتلة الاحتمالية، مما يعزز استكشاف المسارات المتنوعة ويحسن أداء Pass@k في النماذج اللغوية الكبيرة الموجهة نحو الاستنتاج.

Yifu Huo, Chenglong Wang, Ziming Zhu, Shunjie Xing, Peinan Feng, Tongran Liu, Qiaozhi He, Tianhua Zhou, Xiaojia Chang, J (…)2026-04-21
💬 NLP

Beyond Black-Box Labels: Interpretable Criteria for Diagnosing SubjectiveNLP Tasks

تقترح هذه الورقة طريقة تشخيصية على مستوى المخطط تستخدم أحكام معايير متعددة للمُعلقين لتحديد والتمييز بين المعايير غير المستقرة والتداخلات الفئوية المنهجية في مهام معالجة اللغات الطبيعية الذاتية قبل الانتهاء من الملصقات الذهبية، مما يتيح إجراء تحسينات قائمة على الأدلة لإرشادات وهياكل التعليق.

Nisrine Rair, Alban Goupil, Valeriu Vrabie, Emmanuel Chochoy2026-04-21
💬 NLP

Where is the Mind? Persona Vectors and LLM Individuation

تتناول هذه الورقة مشكلة تفرّد النماذج اللغوية الكبيرة من خلال الاستفادة من التفسير الآلي وأبحاث ناقلات الشخصية لاقتراح وتقييم ثلاثة مرشحين رائدين لتحديد العقول داخل النماذج اللغوية الكبيرة: وجهة نظر النسخة الافتراضية، ووجهة نظر النسخة-الشخصية، ووجهة نظر النموذج-الشخصية.

Pierre Beckmann, Patrick Butlin2026-04-21
💬 NLP

Efficient Task Adaptation in Large Language Models via Selective Parameter Optimization

تقترح هذه الورقة طريقة لتحسين المعلمات الانتقائية تميز وتجمد "المعلمات الجوهرية" الضرورية للقدرات اللغوية العامة مع ضبط "المعلمات غير الجوهرية" فقط للمجالات المتخصصة، مما يقلل من النسيان الكارثي ويعزز قدرة النموذج على التكيف عبر المهام العلمية والطبية والفيزيائية.

Weijie Wan, Jiangjiang Zhao2026-04-21
💬 NLP

Stability-Weighted Decoding for Diffusion Language Models

تقدم هذه الورقة "فك التشفير الموزون بالاستقرار" (Stability-Weighted Decoding - SWD)، وهي استراتيجية خالية من التدريب لنماذج الانتشار اللغوية تستفيد من عدم الاستقرار الزمني للرموز لمنع كشف القناع المبكر، مما يحسن بشكل كبير من دقة التوليد ومتانته في مهام البرمجة والرياضيات.

Yue Wu, Jian Huang2026-04-21
💬 NLP

Auditing Support Strategies in LLMs through Grounded Multi-Turn Social Simulation

تقدم هذه الورقة إطار عمل للمحاكاة الاجتماعية متعددة الأدوار والمستندة إلى سياق واقعي لتدقيق النماذج اللغوية الكبيرة، كاشفةً أن استراتيجيات الدعم تتغير ديناميكياً استجابةً لتقدير ضيق المستخدم وسياق المجتمع، وهي نتائج تظل غير مرئية لعمليات التقييم التقليدية أحادية الدور.

Michelle Star, Andrew Aquilina, Yu-Ru Lin2026-04-21