💬 NLP

Keep It InMind: Benchmarking the Implicit-Association Blind Spot in Agent Memory

تقدم الورقة البحثية InMind، وهو معيار شامل يكشف أن أنظمة ذاكرة الوكلاء الحالية تعاني من "نقطة عمياء في الارتباط الضمني" حرجة، حيث تفشل في استرجاع الحقائق المخزنة اللازمة للاستعلامات غير المباشرة بسبب قيود الواجهة بدلاً من نقص التخزين أو المعرفة، مما يسلط الض الضوء على الحاجة إلى آليات توجيه محسنة للحفاظ على السياق ذي الصلة.

Ruizhe Li, Mingxuan Du, Benfeng Xu, Zhendong Mao2026-07-28
💬 NLP

Occluded Oculus: Operationalizing Stylistic Obscurement

تقدم هذه الورقة دراسة استئصال للإطار التنافسي TraceTarnish\textit{TraceTarnish} لإثبات أن حقن رموز يونيكود ذات العرض الصفري، والرموز المتشابهة (homoglyphs)، والأخطاء الإملائية المتعمدة، هو الاستراتيجية الأكثر فعالية لتحييد أنظمة عزو التأليف الأسلوبي.

Robert Dilworth2026-07-28
💬 NLP

LEX-EC: A Lexical Evidence-Channel Audit Framework for Zero-Shot LLM Personality Classification in Black-Box Settings

تقدم هذه الورقة LEX-EC، وهو إطار تدقيق للنماذج الصندوقية السوداء يجمع بين تشخيصات الانتشار، والاستئصال المعجمي، وتحليل حساسية المطالبة، للتمييز بين تأثيرات التوزيع الهامشي والإشارات الحقيقية المرتبطة بالسمات في تصنيف الشخصية لنماذج اللغات الكبيرة ذات التعلم الصفري عبر أنواع نصوص متنوعة.

Brittany Harbison, Ashok K. Goel2026-07-28
💬 NLP

Bigger or Cheaper? Scale and Quantization Effects on Uncertainty Signals in Vision-Language Models Under Image Degradation

تُثبت هذه الورقة أنه بالنسبة لنماذج الرؤية واللغة التي تعمل ضمن ميزانية ذاكرة ثابتة، فإن اختيار نموذج مكمّم أكبر حجماً على نموذج أصغر بدقة كاملة هو الخيار الأمثل لأن الحجم يحسن بشكل كبير من الكشف عن عدم اليقين الداخلي بينما يحافظ التكميم على الدقة، رغم تدهور إشارات الثقة اللفظية.

M M Asif Ferdous2026-07-28
💬 NLP

Grounding latent algorithm routing in transformer reasoning

تقدم هذه الورقة ROUTEBENCH وتثبت أن نماذج المحولات الكثيفة (dense transformers) التي يتم تدريبها من الصفر يمكنها تطوير آليات توجيه داخلية مستقرة وقابلة للتفسير لاختيار عائلات الحلول بشكل تكيفي بناءً على أنظمة البيانات الكامنة، محققةً دقة توجيه عالية ومتانة عبر مختلف الاضطرابات والتمثيلات اللغوية الطبيعية.

Xiangbo Zhang, Xiaoxu Ma2026-07-28
🤖 machine learning

What do Reward Models Memorize?

تكشف هذه الورقة أن نماذج المكافأة المدربة تمييزياً تظهر حفظاً متحيزاً من خلال الإفراط في التخصيص لأزواج التفضيل السهلة، والاختصارات الخاصة بمجموعات البيانات، والاستدلالات البسيطة، مما يحد في النهاية من قدرتها على الحكم بدقة على جودة الاستجابة في السيناريوهات المعتمدة على السياق.

Ivo Verhoeven, Pushkar Mishra, Ekaterina Shutova2026-07-28
💬 NLP

From Data to Device: ELMOD An Efficient German-First 2.7B Language Model for Mobile Inference

إن ELMOD هو نموذج لغوي ألماني مدمج بحجم 2.7 مليار معلمة، صُمم من أجل الاستنتاج الفعال على الأجهزة، والذي يحقق من خلال معالجة مسبقة متخصصة للبيانات وتصفية نوعية أداءً يضاهي النماذج ذات الـ 7 مليارات معلمة، وذلك أثناء العمل في ظل ميزانية حوسبة محدودة.

Darina Gold, Alexander Schwirjow, Viktor Haag, Viktor Hangya, Joel Schlotthauer, Fabian Küch, Luzian Hahn2026-07-28
💬 NLP

D-Score: A Spectral Hidden-State Signal for Hallucination Detection in Large Language Models

تقدم هذه الورقة البحثية D-Score، وهي طريقة للكشف عن الهلوسة في النماذج اللغوية الكبيرة تقوم بتحليل الهندسة الطيفية لتنشيطات الحالات الخفية خلال تمريرة أمامية واحدة لتحديد أوجه عدم الاتساق بين النص المُولد والمعرفة الداخلية للنموذج، مما يلغي الحاجة إلى مُحقِّقات خارجية أو عمليات توليد متعددة.

Bianca Raimondi, Davide Evangelista, Maurizio Gabbrielli, Elena Loli Piccolomini2026-07-28
💬 NLP

Sparse Autoencoders Encode Both Concepts and Functions: The Downstream Geometry of Feature Effects

تقدم هذه الورقة تحليل هندسة التأثير-الميزة (FEGA) لتوضيح أنه بينما يمكن لميزات المشفّر التلقائي المتناثر أن تكون ذات صلة سببية، إلا أنها نادراً ما تعمل كاتجاهات توجيه مستقرة، حيث تُظهر بدلاً من ذلك أنماطاً هندسية متميزة حيث تنتج الميزات "الشبيهة بالقيمة" تأثيرات مهيكلة، بينما تولد الميزات "الشبيهة بالمؤشر" تغيرات منتشرة ومعتمدة على السياق.

Phu Gia Hoang, Anwoy Chatterjee, Tanmoy Chakraborty, Iryna Gurevych, Subhabrata Dutta2026-07-28
💬 NLP

Evidence Attribution in Visual Document Understanding without Coordinates or Region Labels

تُثبت هذه الورقة أن استبدال مخرجات الصناديق المحيطة القائمة على الإحداثيات بواجهة نصية تعتمد على "الاقتباس والاسترجاع" يقلل بشكل كبير من هلوسة الإسناد ويحسن استدعاء الأدلة في فهم المستندات المرئية، مع تمكين التدريب الفعال أيضاً دون الحاجة إلى تسميات مكلفة على مستوى المنطقة.

Zhuchenyang Liu, Yao Zhang, Yu Xiao2026-07-28