💬 NLP

How China-Origin Vision-Language Models Move from Refusal to Reframing in State Alignment

تكشف هذه الورقة أن نماذج الرؤية واللغة ذات الأصل الصيني تتحول بشكل متزايد من الرفض الصريح إلى "إعادة صياغة" سلسة وخفية للمحتوى الحساس سياسياً — وهو شكل من أشكال الرقابة غير المرئية التي تزداد انتشاراً في المطالبات الصينية، والتي يتم تحفيزها عبر التعرف على الموضوع بدلاً من التفاصيل البصرية، مما يشكل تحدياً كبيراً للتفاعل بين الإنسان والذكاء الاصطناعي من خلال حجب عملية حجب المعلومات.

Guang Yang, Fengchen Liu, Alex Wang, Homa Hosseinmardi, Amir Ghasemian2026-08-13
💬 NLP

Located but Not Releasable: Silent Gate Inversion and Bounded Linear Release

تُظهر هذه الدراسة المسجلة مسبقاً أنه بينما يمكن تحديد البنية السببية الكامنة في نموذج لغوي بنجاح وتحديد موقعها واستعادتها جزئياً عبر التدخل، فإن محاولات تحويل هذا الكشف إلى تحرير سلوكي موثوق تفشل بسبب انقلاب خارج النطاق المعتاد للمكتشف وسقف جوهري في فعالية اتجاهات التحرير الخطية.

Xining Xun2026-08-13
💬 NLP

Quantifying the Relationship Between Clinical Safety and Environmental Impact in Therapeutic LLMs

تكشف هذه الورقة عن مقايضة غير خطية بين السلامة السريرية والأثر البيئي في النماذج اللغوية الكبيرة العلاجية، حيث تُظهر أن مكاسب السلامة الهامشية عند الحد الأعلى تأتي بتكاليف طاقة باهظة بشكل غير متناسب، وأن مجرد زيادة حجم النموذج أو حسابات وقت الاختبار غالباً ما تكون استراتيجية غير فعالة لتحسين السلامة.

Alireza A. Safaei, Laura M. Vowels, Matthew J. Vowels, Apoorv Jha, Shekoufeh Rahimi2026-08-13
💬 NLP

LookBack: Where and How to Score LVLM Responses via Visual Reference Usage

تقدم هذه الورقة البحثية "LookBack"، وهي طريقة لا تتطلب تدريباً تعمل على تحسين تقييم استجابات النماذج اللغوية الكبيرة متعددة الوسائط (LVLM) من خلال تعزيز احتمالية الرموز (token likelihood) بدرجة "النظر إلى الخلف" البصرية (visual lookback score) للكشف بشكل أفضل عن الهلوسة واختيار المخرات المرتكزة على المحتوى، مما يعالج أوجه القصور في المقاييس الحالية القائمة على الثقة.

Beomsik Cho, Jinhyeong Kim, Dongseok Lee, Jaehyung Kim2026-08-13
💬 NLP

Total Recall at What Cost? Benchmarking the Serving Cost of Agentic Memory Systems

تقوم هذه الورقة البحثية بقياس تكاليف الخدمة ودقة ثلاثة أنظمة ذاكرة وكيلية مقابل الاستراتيجيات القياسية، كاشفةً أن التكاليف مدفوعة بسلوكيات النظام الداخلية وليس بطول المحادثة وحدها، وتتفاوت بشكل كبير عبر مختلف النماذج الأساسية والأنظمة، وتتضمن مقايضة لا يوجد فيها حل واحد يحسن كلاً من التكلفة والدقة معاً.

Natchanon Pollertlam, Witchayut Kornsuwannawit2026-08-13
💬 NLP

DexterSQL: Deep Schema Exploration and Rule-based Correction for Text-to-SQL Generation

يُعد DexterSQL نظاماً لتحويل النصوص إلى لغة SQL يعتمد على التلقين، وهو يعمل على تعزيز دقة التوليد دون الحاجة إلى الضبط الدقيق من خلال دمج الاستكشاف العميق للمخطط لحل غموض الأعمدة، وتنقيب القواعد المستقلة عن قواعد البيانات لتصحيح إخفاقات النماذج اللغوية الكبيرة المتكررة، وتوظيف التوليد متعدد المسارات الموجه بأشجار التبعية لتحسين التعامل مع الشروط في الاستعلامات المعقدة.

Anik Pramanik, Murat Kantarcioglu, Vincent Oria, Shantanu Sharma2026-08-13
💬 NLP

LazyTrain: Limited-resource Allocation toward Zero-waste Yield Optimization in Large Language Model Training

تُعد LazyTrain طبقة تحسين لجدولة الأعداد الصحيحة المختلطة لمنفذات تدفق الطبقات، والتي تنسق ديناميكيًا بين نقاط التحقق، وتوزيع التنشيط، وتداخل الاتصالات مع دمج عامل هجين بـ 8 بت، مما يتيح تدريبًا عالي الإنتاجية وبدون هدر للنماذج اللغوية الكبيرة على موارد الأجهزة المحدودة.

Xiaojun Wu, Cehao Yang, Honghao Liu, Xueyuan Lin, Xuhui Jiang, Chengjin Xu, Jia Li, Jian Guo2026-08-13
💬 NLP

Accuracy and Order Sensitivity Diverge Under Label-Free Strategies

توضح هذه الورقة أنه في حين أن منع النماذج اللغوية الكبيرة من رؤية تسميات الخيارات أثناء الإجابة على الأسئلة متعددة الخيارات يزيل بنجاح الانحياز الموقعي، إلا أنه يفشل في تحسين الدقة وغالبًا ما يؤدي إلى تدهور الأداء، مما يكشف أن العائق الأساسي هو حجب الخيارات وليس آلية المطابقة.

Karl Hanna, Chen Feng2026-08-13
🤖 AI

Claim-Level Reliability Assessment for Efficient Test-Time Reasoning

تقترح الورقة البحثية إطار عمل لتقييم موثوقية مستوى الادعاء (CLR)، وهو إطار عمل لا يتطلب تدريباً يعزز كفاءة الاستنتاج في وقت الاختبار من خلال الانتقال من تقييم المسار الكامل إلى التكذيب المستهدف على مستوى الادعاء، مما يعيد تخصيص الحوسبة للتحقق من الادعاءات الحاسمة للقرار ويحسن الدقة بشكل كبير مع تقليل استخدام الرموز (tokens).

Sen Xu, Wei Wang, Shixi Liu, Jixin Min, Yingwei Dai, Zhibin Yin, Yirong Chen, Junlin Zhang2026-08-13
💬 NLP

Structuring the Space of Perspectives

تتناول هذه الورقة العلاقات غير الواضحة بين المفاهيم المختلفة المتعلقة بالمنظور في معالجة اللغات الطبيعية من خلال مراجعة المجال، وتحديد الخصائص المميزة، واقتراح إطار هرمي خطي لمساعدة الباحثين على اختيار عمليات التشغيل المناسبة والمتوافقة مع أهدافهم المحددة.

Agnese Daffara, Sebastian Padó, Tanise Ceron2026-08-13