🤖 machine learning

Trust the Mass: Forced Weights in KV-Cache Eviction

تجادل هذه الورقة بأن مكاسب الأداء لطرق استبعاد ذاكرة التخزين المؤقت لـ KV الحالية تنبع غالباً من مزايا ضمنية في ميزانية الذاكرة بدلاً من استراتيجيات اختيار متفوقة، وتقدم ContourKV، وهو مخصص خالٍ من التدريب يعتمد على إحصائيات "الكتلة المفقودة" يحقق نتائج رائدة مع فرض قيود الذاكرة بصرامة.

Jack Shi, Jerry Gu2026-08-27
🤖 machine learning

Output Dilution: Redundant but Fragile Representations in MoE Models

تكشف هذه الورقة أنه بينما تقوم نماذج "خليط الخبراء" (MoE) بترميز المحتوى الأخلاقي بنفس قدر التكرار الذي تقوم به النماذج الكثيفة، إلا أن تمثيلاتها أكثر هشاشة بشكل ملحوظ بسبب "تخفيف المخرجات"، حيث يؤدي متوسط الخبراء النشطين إلى تقليل قوة الإشارة بشكل جذري، مما يجعل المعلومات المرمزة عرضة للاكتساح بسهما من قبل الضجيج رغم استقرار التوجيه.

Orion Reblitz-Richardson2026-08-27
💬 NLP

Rare Diseases, Common Dilemmas: LLMs Prioritize Equal Resource Distribution over Patient Benefit in Decision-Making

تكشف هذه الدراسة أن النماذج اللغوية الكبيرة المتطورة، عند عرض سيناريوهات الأمراض النادرة ذات المخاطر العالية عليها، تعطي الأولوية باستمرار للتوزيع المتساوي للموارد (العدالة) على حساب المنافع الخاصة بالمريض (الإحسان) والاستقلالية، وهو انحياز يتم تعديله بشكل أكبر بناءً على ما إذا كانت القرارات مؤطرة كخيارات مؤسسية أو فردية.

Minda Zhao, Xu Han, Rishabh Goel, Maya Dagan, Noa Dagan, Adithya Madduri, Payal Chandak, Shilpa Nadimpalli Kobren, Isaac (…)2026-08-27
💬 NLP

The "Curse of Knowledge" in LLM Query Simulation: Concept Provenance for Tracing Answer-Side Intrusion

تقدم هذه الورقة "أصل المفهوم" (concept provenance)، وهو إطار عمل للكشف عن تداخل المعرفة من جانب الإجابة وتصنيفها في استعلامات البحث التي تولدها النماذج اللغوية الكبيرة، مما يكشف عن أن هذا التداخل، رغم كونه شائعاً ومتميزاً عن التباين البشري الطبيعي، إلا أن له تأثيراً ضئيلاً على مقاييس تقييم الاسترجاع الإجمالية، ولكن يمكن القضاء عليه بفعالية من خلال الاختيار ما بعد التوليد.

Chenglong Ma, Xinye Wanyan, Danula Hettiachchi, Ziqi Xu, Jeffrey Chan2026-08-27
💬 NLP

Learning What to Share and What to Personalize: Hierarchical Strategy Co-Evolution for Agent Memory

تقترح هذه الورقة إطار عمل HiPS، وهو إطار هرمي يطور بشكل مشترك استراتيجية ذاكرة مشتركة عالمياً مع قواعد تكيفية خاصة بكل مستخدم لتحسين ما تحتفظ به الوكلاء أو تتخلص منه من المعلومات ديناميكياً من أجل التفاعلات الشخصية.

Yupeng Han, Shuochen Liu, Kai Zhang, Ze Liu, Zhihong Pan, Xianquan Wang2026-08-27
💬 NLP

Provenance Before Prose: Claim-Locked Reporting

تقدم هذه الورقة "التقارير المقيدة بالادعاء"، وهو بروتوكول "الأصل قبل النثر" الذي يثبت الأدلة الإحصائية ومعايير الادعاء قبل توليد اللغة، مما يحسن بشكل كبير من قابلية إعادة الإنتاج الرقمي ويقلل التكاليف الحسابية مقارنة بطرق القوالب الهجينة الحالية.

Xiao Fan, Jingyuan Li, Hongbin Guo, Yubo Han, Yi Zhang2026-08-27
💬 NLP

GUIDE: Generative Unsupervised Chinese Query Correction via Phonetic and Visual Shared-ID Encoding

تقدم هذه الورقة البحثية إطار العمل التوليدي غير الخاضع للإشراف \textsc{GUIDE} لتصحيح الاستعلامات باللغة الصينية، والذي يعتمد نموذج "الإرباك ثم التوضيح" مع معرفات صوتية وبصرية مشتركة لمنع انحراف القصد بفعالية والتكيف مع المفردات المتطورة دون الاعتماد على بيانات مشروحة مكلفة.

Lei Yang, Binbin Huang, Jiwei Tan, Xuhui Sui, Chang Tu, Yi Wang, Han Li2026-08-27
💬 NLP

Short Horizons and Sparse Concepts: a Mathematical View of the Readout in the J-lens

تقدم هذه الورقة إطاراً رياضياً لعدسة جاكوبيان (J-lens) من خلال توصيفها كعامل نقل سببي متناثر وقصير الأفق، يقوم بتفكيك التنشيطات الوسيطة إلى تنبؤات لمفاهيم محددة، مما يوفر أساساً نظرياً لاستراتيجية قراءة محسنة تعزز تصور المفاهيم الوسيطة الصحيحة في النماذج اللغوية.

Shi-Qi Yan, Kai-Xuan Ding, Chao-Hong Tan, Qian Chen, Wen Wang, Xiangang Li, Zhen-Hua Ling2026-08-27
🤖 machine learning

Escaping Low-Dimensional Overlap: Multi-Task Model Merging via High-Dimensional Sparse Disentanglement

تقترح هذه الورقة إطار عمل جديد لدمج النماذج يستفيد من المشفرات التلقائية المتفرقة لإسقاط ناقلات المهام في فضاء سمات عالي الأبعاد ومتفرق لفك تشابك السمات المتداخلة بفعالية، مقترناً بمحسن من الدرجة الصفرية مصنف مجموعات خفيف الوزن للدمج الانتقائي للطبقات، مما يتفوق بشكل كبير على النماذج المرجعية الحالية عبر مهام متنوعة.

Yihang Zhang, Shengke Sun, Junjie Wen, Feng Zeng2026-08-27
💬 NLP

GGSS: Geodesic-Gated Spherical Steering for Inference-Time Debiasing of Generative Vision-Language Models

تقدم الورقة البحثية تقنية GGSS، وهي تدخل في وقت الاستدلال يحافظ على المعيار ويوجه الرموز البصرية على طول أقواس جيوديسية على كرة فائقة الوحدة لتقليل التحيز الديموغرافي بفعالية في نماذج الرؤية واللغة التوليدية مع الحفاظ على قدراتها الأساسية في الربط بين الرؤية واللغة.

Yiqun Sun, Junyu Chen, Pengfei Wei, Lawrence B. Hsieh2026-08-27