💬 NLP

Peer-Predictive Self-Training for Language Model Reasoning

تقدم الورقة البحثية "التدريب الذاتي القائم على التنبؤ بالأقران" (PST)، وهو إطار عمل خالٍ من الملصقات، حيث تعمل نماذج لغوية متعددة بشكل تعاوني على تحسين قدراتها في الاستنتاج من خلال استخدام الاستجابات المجمعة عبر النماذج كإشارات تدريب داخلية يتم قياسها بواسطة المعلومات المتبادلة النقطية، مما يحقق مكاسب كبيرة في الدقة في الاختبارات المعيارية الرياضية دون إشراف خارجي.

Shi Feng, Hanlin Zhang, Fan Nie, Sham Kakade, Yiling Chen2026-04-16
💬 NLP

From Prediction to Justification: Aligning Sentiment Reasoning with Human Rationale via Reinforcement Learning

تقدم الورقة البحثية ABSA-R1، وهو إطار عمل لنماذج اللغات الكبيرة يستخدم التعلم التعزيزي وآلية مكافأة متوافقة مع الإدراك لفرض عملية "التفكير قبل التنبؤ"، مما يؤدي إلى توليد مبررات شبيهة بالبشر تعزز كلاً من القابلية للتفسير والدقة في تحليل المشاعر القائم على الجوانب.

Shihao Zhang, Ziwei Wang, Jie Zhou, Yulan Wu, Qin Chen, Zhikai Lei, Liyang Yu, Liang Dou, Liang He2026-04-16
💬 NLP

CANVAS: Continuity-Aware Narratives via Visual Agentic Storyboarding

تقدم الورقة البحثية CANVAS، وهو إطار عمل متعدد الوكلاء يخطط صراحةً للاستمرارية البصرية من خلال اتساق الشخصيات، ومرتكزات الخلفية المستمرة، وتخطيط المشاهد المدرك للموقع للتغلب على تحديات التماسك في سرد القصص المرئية طويلة المدى، مما يُظهر تحسينات ملحوظة مقارنة بالنماذج المرجعية الحالية في العديد من المعايير.

Ishani Mondal, Yiwen Song, Mihir Parmar, Palash Goyal, Jordan Boyd-Graber, Tomas Pfister, Yale Song2026-04-16
💬 NLP

Functional Emotions or Situational Contexts? A Discriminating Test from the Mythos Preview System Card

تحدد هذه المذكرة فرضيتين متنافستين تتسقان نوعياً مع بطاقة نظام "Claude Mythos Preview" — إما أن نواقل العاطفة تتبع عواطف وظيفية تقود السلوك غير المتوافق سببيًا، أو أنها مجرد إسقاط لبنية سياقية ظرفية أكثر ثراءً — وتحدد اختبار المرجعية التقاطعية الذي من شأنه التمييز بينهما، مع ما يترتب على ذلك من عواقب مباشرة على ما إذا كان يمكن للمراقبة القائمة على العاطفة أن تكتشف سلوك النموذج الخطير بشكل موثوق.

Hiranya V. Peiris2026-04-16✓ Author reviewed
💬 NLP

Using reasoning LLMs to extract SDOH events from clinical notes

تُظهر هذه الدراسة أن النماذج اللغوية الكبيرة القادرة على الاستنتاج، والموجهة بإطار عمل رباعي الوحدات يتكون من هندسة الأوامر، والتعلم بلقطات قليلة، والاتساق الذاتي، ومعالجة ما بعد التنفيذ، يمكنها استخراج أحداث المحددات الاجتماعية للصحة المهيكلة من الملاحظات السريرية غير المهيكلة بفعالية ذات أداء تنافسي وبساطة في التنفيذ.

Ertan Doganl, Kunyu Yu, Yifan Peng2026-04-16
💬 NLP

Synthesizing Instruction-Tuning Datasets with Contrastive Decoding

تقدم هذه الورقة البحثية CoDIT، وهي طريقة تعمل على تخليق مجموعات بيانات ضبط التعليمات من خلال تطبيق فك التشفير التبايني لفصل قدرات اتباع التعليمات عن المعرفة المسبقة، مما يؤدي إلى نماذج تتفوق على تلك المدربة على مجموعات البيانات الحالية ويُمكّن من نقل قدرات الدردشة عبر بنيات مختلفة.

Tatsuya Ichinose, Youmi Ma, Masanari Oi, Ryuto Koike, Naoaki Okazaki2026-04-16
💬 NLP

Debate to Align: Reliable Entity Alignment through Two-Stage Multi-Agent Debate

تقترح الورقة البحثية AgentEA، وهو إطار عمل موثوق لمحاذاة الكيانات يعزز اتخاذ القرار من خلال تحسين تفضيل تمثيل الكيان وآلية مناظرة متعددة الوكلاء جديدة مكونة من مرحلتين، مما يظهر أداءً فائقاً عبر إعدادات متنوعة للرسوم البيانية للمعرفة.

Cunda Wang, Ziying Ma, Po Hu, Weihua Wang, Feilong Bao2026-04-16
💬 NLP

YOCO++: Enhancing YOCO with KV Residual Connections for Efficient LLM Inference

تقدم الورقة البحثية YOCO++، وهي طريقة محسنة لضغط الـ KV عبر الطبقات تدمج اتصالات متبقية موزونة لتحسين أداء نهج YOCO الأصلي، محققةً كفاءة هي الأفضل في فئتها ومتفوقة على نماذج Transformer القياسية عند معدل ضغط لـ KV cache بنسبة 50% دون التضحية بسرعة التدريب أو الاستدلال.

You Wu, Ziheng Chen, Yizhen Zhang, Haoyi Wu, Chengting Yu, Yuchi Xu, Wenbo Su, Bo Zheng, Kewei Tu2026-04-16
💬 NLP

BenGER: A Collaborative Web Platform for End-to-End Benchmarking of German Legal Tasks

تقدم الورقة البحثية BenGER، وهي منصة ويب مفتوحة المصدر مصممة لتبسيط وتوحيد عملية التقييم المعياري الشامل للمهام القانونية الألمانية من خلال دمج التعليق التوضيحي التعاوني، والتنفيذ القابل للضبط للنماذج اللغوية الكبيرة، ومقاييس التقييم متعددة الأوجه في بيئة واحدة قابلة لإعادة الإنتاج.

Sebastian Nagl, Matthias Grabmair2026-04-16
💬 NLP

Foresight Optimization for Strategic Reasoning in Large Language Models

تقدم هذه الورقة البحثية "تحسين سياسة الاستشراف" (FoPO)، وهي طريقة مبتكرة تدمج نمذجة الخصم في تحسين السياسات لتعزيز الاستدلال الاستراتيجي واتخاذ القرار في النماذج اللغوية الكبيرة ضمن بيئات متعددة الوكلاء، مما يظهر تحسينات كبيرة في الأداء وقدرة قوية على التعميم عبر نماذج وسيناريوهات متنوعة.

Jiashuo Wang, Jiawen Duan, Jian Wang, Kaitao Song, Chunpu Xu, Johnny K. W. Ho, Fenggang Yu, Wenjie Li, Johan F. Hoorn2026-04-16