💬 NLP

When Activation Oracles Learn Not to Read: Concept-Specific Blind Spots in Fine-Tuned Oracles

تكشف هذه الورقة أن "أوراكل التنشيط" (Activation Oracles)، على الرغم من تدريبها لتفسير التنشيطات الداخلية للنموذج الخاضع للدراسة، يمكن أن تطور "نقاط عمياء" خاصة بمفاهيم معينة حيث تفشل في الإبلاغ عن مفهوم خفي يظل قابلاً لفك التشفير ضمن تمثيلاتها الخاصة، مما يظهر انفصالاً حرجاً بين المعلومات على مستوى التمثيل وبين موثوقية واجهات التفسير المتعلمة.

Tobias Bersia, Tatiana Gaintseva2026-07-28
💬 NLP

Do Small Models Use the Law You Give Them? Context-Injected Fine-Tuning for Legal QA in Bangladesh

تُثبت هذه الورقة أن الضبط الدقيق للنماذج اللغوية الصغيرة ثنائية اللغة باستخدام أمثلة قانونية محقونة بالسياق يحسن بشكل كبير قدرتها على التطبيق الصحيح للنصوص التشريعية البنغلاديشية المسترجعة والحفاظ على اتساق اللغة، رغم أن هذه المكاسب تتباين باختلاف حجم النموذج ولا تفيد النماذج الأكبر حجماً بشكل موحد.

Moniruzzaman Mahadi, Abrar Mohammed Tanzim Alam, Sayma Siddika Monalisa, Mir Mohammad Asif Abdullah, Swakkhar Shatabda (…)2026-07-28
💬 NLP

Two Regimes of Chain-of-Thought Unfaithfulness: Behavioral Detection Fails Where Models Are Wrong

تكشف هذه الورقة أن الكشف السلوكي عن تسلسل الأفكار غير الأمين يفشل أساساً في الإجابات غير الصحيحة — حيث يحدث معظم عدم الأمانة — لأن صحة الإجابة تهيكل المشكلة بشكل جوهري، مما يجعل الإشارات القياسية غير فعالة ويكشف عن قصور حرج في أساليب الإشراف الحالية.

Suramya R. Angdembay, Dikshant Aryal, Nick Rahimi2026-07-28
💬 NLP

Mwando: Leveraging AI to Preserve and Teach shiKomori

تقدم هذه الورقة "مواندو" (Mwando)، وهو مساعد تعليمي ذكاء اصطناعي متعدد الوكلاء يستفيد من قاعدة معرفية من العبارات والأمثال والقواعد لتعليم وحفظ اللهجات الأربع للغة "شي كوموري"، مما يقدم مخططاً قابلاً للتوسع لدعم اللغات الأخرى ذات الموارد المحدودة.

Naira Abdou Mohamed, Haidar Nassur Said Ali, Mohamed Hazra, Naoufal Mohamed Soibira, Roushnaty Ali Yamani2026-07-28
💬 NLP

Novel Claim or Déjà Vu? Rethinking "Contamination-Free'' Dynamic Evaluation for Multimodal Automated Fact-Checking

تتحدى هذه الورقة الافتراض القائل بأن المعايير المرجعية الديناميكية خالية بطبيعتها من التلوث، وذلك من خلال إثبات أن جزءاً كبيراً من الادعاءات التي تلت تاريخ القطع لا تزال قابلة للتحقق عبر المعرفة الموجودة مسبقاً، مما يمكن أن يؤدي إلى تضخيم أداء التحقق من الحقائق متعدد الوسائط بشكل مصطنع وتشويه تصنيفات الأنظمة، الأمر الذي يستلزم بروتوكولات تقييم أكثر صرامة.

Haorui He, Xinwen Chen, Dacheng Wen, Reynold Cheng, Francis C. M. Lau, Yupeng Li2026-07-28✓ Author reviewed
💬 NLP

The JEPA Paradox in Language: The Geometry of Linguistic Alternatives

تجادل هذه الورقة بأن بنيات التضمين المشترك التنبؤية (JEPAs) الحتمية تفشل في التعامل مع اللغة لأن تعدد الأنماط المتأصل في النصوص ينتهك التركيز الشرطي المطلوب للتنبؤ بالكمون عبر الخطأ التربيعي، مما يؤدي إلى انهيار تمثيلي وأداء ضعيف في المهام اللاحقة ما لم يتم إعادة تصميم الأهداف للحفاظ على عدة إتمامات محتملة.

Anh Trac Duc Dinh, Khang Nhat Hoang Vo2026-07-28
💬 NLP

Guiding Language Models to Be More Empathetic: Culturally Sensitive Mental Health Advice Generation Through Human-LLM Collaboration

تتناول هذه الورقة نقص توليد النصائح المتعلقة بالصحة النفسية الحساسة ثقافياً في اللغات ذات الموارد المحدودة من خلال تنسيق مجموعة بيانات بنغلاديشية جديدة وتقديم إطار عمل التلقين RP-RCAF ونظام التقييم G-REFS، واللذين يُمكّنان نماذج اللغات الكبيرة معاً من إنتاج استجابات استشارية متعاطفة ومتوافقة أخلاقياً تتفوق على الطرق التقليدية.

Fatema Tuj Johora Faria, Mukaffi Bin Moin, Md. Mahfuzur Rahman, Khan Md Hasib, Jubayer Al Mahmud, M. F. Mridha2026-07-28
🤖 machine learning

MS-GPT: Rethinking MS/MS De Novo Structure Elucidation as Spectrum-Induced Posterior Querying of a Molecule-Language Model

تقدم الورقة البحثية MS-GPT، وهو إطار عمل مبتكر يعيد صياغة استنباط بنية MS/MS من الصفر كعملية استعلام عن التوزيع اللاحق المستحث بالطيف لنموذج لغوي جزيئي شرطي، محققاً دقة هي الأفضل في فئتها من خلال معالجة عدم التطابق بين التدريب والاستدلال عبر معايرة كثافة البت النشط والترتيب القائم على الإجماع للمرشحين.

Xin Zhao, Yumin Liu, Zhuo Li, Weichu Zheng, Feng Zhu, Xiaokang Yang, Yaohui Jin, Yanyan Xu2026-07-28
💬 NLP

Where Is the Cost of Third-Party API Routers in Agentic Software Development?

تثبت هذه الورقة تجريبياً أن أجهزة توجيه واجهة برمجة التطبيقات (API routers) التابعة لجهات خارجية في تطوير البرمجيات الوكيلية (agentic software development) تُحدث فجوة تحكم حرجة حيث يمكن لعمليات الحقن من جانب جهاز التوجيه أن تغير أفعال الوكيل بصمت وتتجاوز الدفاعات من جانب العميل، محققةً نسبة نجاح دفاعي بلغت 0% عبر جميع الوكلاء الذين تم تقييمهم، مما يسلط الضوء على الحاجة الملحة لضمانات سلامة المخرجات من جانب المزود.

Donghao Fu, Jingxin Li, Xue Jiang, Yihong Dong2026-07-28