🤖 AI

Does the Competitive Component of Adversarial Self-Play Improve Legal Reasoning? A Controlled Negative Result

تفيد هذه الورقة بتقرير نتيجة سلبية منضبطة تُظهر أن إضافة مكون اللعب الذاتي التنافسي العدائي إلى تدريب الاستدلال القانوني لا يحقق أي تحسن في الأداء مقارنة بالنماذج المرجعية غير التنافسية، مما يشير إلى أن قيمة نهج تعدد المعلمين هذا تنبع من بناء بيئات قابلة للتحقق بدلاً من الديناميكية التنافسية نفسها.

Miseog Shawn Kim2026-08-04
💬 NLP

Discriminative Axis, Not Data Volume: What a Contrastive Corpus Teaches an Audio Embedding

تُثبت هذه الورقة أن السمات المشفرة في تمثيلات الصوت التباينية تتحدد من خلال التصميم الهيكلي لمجموعة بيانات التدريب — وتحديداً ضرورة وجود السمة للتمييز بين العينات السالبة داخل الدفعة — وليس من خلال حجم المجموعة أو مفردات التعليقات الوصفية، كما يتضح من القدرة على استعادة أو كبح التعرف على الانفعالات في الكلام بشكل انتقائي من خلال بناء البيانات المنضبط دون الاعتماد على زيادة حجم البيانات.

Abdul Basit Tonmoy2026-08-04
💬 NLP

PICTURE: Enhancing Theory-of-Mind in Large Language Models by Revealing, Not Hiding, Characters' Lack of Knowledge

تقدم الورقة البحثية طريقة PICTURE، وهي طريقة تحفيز تعزز قدرات "نظرية العقل" لدى النماذج اللغوية الكبيرة من خلال الكشف الصريح عن نقص معرفة الشخصيات أثناء الاستدلال الحر، مما يتغلب على قيود الأداء لأساليب إخفاء الأحداث التقليدية ويحقق تحسناً بنسبة 7.3% في مهام الاعتقاد الخاطئ.

Eojin Jeon, SangKeun Lee2026-08-04
💬 NLP

Does Accuracy Equal Evidence? Reasoning Faithfulness under KV Cache Compression

تكشف هذه الورقة أن طرق ضغط ذاكرة التخزين المؤقت لـ (KV cache) يمكنها الحفاظ على دقة الإجابة النهائية العالية مع إضعاف الأمانة والاتساق في مسارات الاستدلال الأساسية بشكل كبير، وهي ظاهرة تُسمى "فجوة الإجابة-الدليل"، مما يشير إلى أن الحفاظ على مسار الاستدلال أكثر أهمية من مجرد تقليل الذاكرة لضمان موثوقية نماذج الاستدلال الكبيرة.

Mengting Ai, Jingrui He, Yue Guo2026-08-04
💬 NLP

Style Wins, Substance Loses: A Diagnosis of LLM-as-Judge in Idea Generation

تقدم هذه الورقة SciStyleBench، وهو معيار شامل يوضح أن حكام النماذج اللغوية الكبيرة (LLMs) ينحازون بشكل كبير لأسلوب الكتابة بدلاً من المضمون العلمي، وتقترح SciStyleExtractor كنموذج فعال للتخفيف من هذا الانحياز مع تحسين دقة تقييم الأفكار.

Fengxian Ji, Yuke Li, Jingpu Yang, Juanfan Wu, Fan Zhang, Zhexuan Cui, Yu Xie, Min Peng, Qianqian Xie, Xiuying Chen, Zhu (…)2026-08-04
💬 NLP

Understanding Sparse Attention Selectivity in Long-Context Foundation Models via Counterfactual Evaluation

تقدم هذه الورقة إطار تقييم مضاد للواقع لإثبات أن آليات الانتباه المتناثر في النماذج التأسيسية ذات السياق الطويل تغير سببياً تأثير كتل محتوى محددة — وغالباً ما تضخم الإشارة بينما تقطع التكامل بين الكتل بطرق تفشل مقاييس الدقة الإجمالية في اكتشافها.

Xingyu Ren, Youran Sun, Chugang Yi, Haizhao Yang2026-08-04
💬 NLP

Floor, Ceiling, and the Fusion Gap: How Much of Crowd Reading Attention Can Machines Predict?

تحدد هذه الورقة حدود الأداء للتنبؤ بالنصوص التي تبرزها الحشود في وثائق الويب، مظهرةً أنه بينما لا تلتقط النماذج اللغوية الرائدة سوى جزء ضئيل من الإشارة، فإن الدمج غير الموزون للنماذج المتنوعة يتفوق بشكل كبير على النماذج الفردية من خلال الاستفادة من بنية المستوى الوثائقي، وهو مكسب يتم الاحتفاظ به بكفاءة بواسطة نموذج طالب مُقطّر.

Kazuki Nakayashiki, Keisuke Watanabe2026-08-04
💬 NLP

PGMem: Tightly Coupled Persona-Memory Graph for Lifelong Personalized Agents

تقدم الورقة البحثية PGMem، وهو رسم بياني لذاكرة الشخصية مترابط بإحكام يربط إشارات شخصية المستخدم بالأحداث الداعمة لها عبر حواف مصدرية نمطية، مما يعالج بفعالية فجوات الصلاحية والاسترجاع للتفوق على أنظمة الذاكرة الحالية في وكلاء الحوار المخصصين مدى الحياة.

Wonjun Choi, Yerim Kim, Yukyung Lee, Susik Yoon2026-08-04
💬 NLP

TIDES: A Longitudinal Bilingual Dataset for Modeling Multi-Party Social Dynamics

تقدم هذه الورقة TIDES، وهي مجموعة بيانات ثنائية اللغة طولية عالية الدقة لـ 12 فريقاً جامعياً على مدار فصل دراسي، والتي تُظهر أنه في حين أن الضبط الدقيق بناءً على تعليقاتها الاجتماعية-البنيوية يحسن بشكل كبير التنبؤ بالمتحدث التالي، إلا أنه لا يعزز بالضرورة طبيعية أو تماسك المحادثات متعددة الأطراف المولدة.

Heechan Lee, Jeonggyu Kang, Junho Myung, Jaywoong Jeong, Juho Kim, Joseph Seering2026-08-04
💬 NLP

Constructing Parallel Multidimensional Chromatic Lexicons for Corpus-Assisted Analysis of Russian and English Texts

تتناول هذه الورقة ندرة الأدوات المخصصة للتحليل القائم على المتون اللغوية للمصطلحات اللونية من خلال تطوير معاجم لونية روسية وإنجليزية متعددة الأبعاد، وإثبات فائدتها عبر دراسة استطلاعية مقارنة لشعر أندريه بيلي وإيميلي ديكنسون، والتي كشفت عن اختلافات لغوية متباينة وهامة في وتيرة وخصائص استخدام الألوان.

Larisa Nikitina2026-08-04