💬 NLP

Answer Bubbles: Information Exposure in AI-Mediated Search

تحلل هذه الدراسة ١١,٠٠٠ استعلام بحث عبر أربعة أنظمة لتكشف أن البحث بوساطة الذكاء الاصطناعي يخلق "فقاعات إجابة" من خلال إظهار تحيزات كبيرة في اختيار المصادر، وتقليل التحوط المعرفي، وتفضيل أنواع معينة من المحتوى مثل ويكيبيديا بشكل غير متناسب مع نقص تمثيل أنواع أخرى، مما يؤدي إلى توليد واقع معلوماتي مختلف بنيوياً للاستعلامات المتطابقة.

Michelle Huang, Agam Goyal, Koustuv Saha, Eshwar Chandrasekharan2026-03-18
💬 NLP

Open-Source Reproduction and Explainability Analysis of Corrective Retrieval Augmented Generation

تقدم هذه الورقة إعادة إنتاج مفتوحة المصدر بالكامل لنظام التوليد المعزز بالاسترجاع التصحيحي (CRAG) باستخدام ويكيبيديا وPhi-3-mini، مما يظهر أداءً مماثلاً للنظام الأصلي مع تقديم أول تحليل قابل للتفسير قائم على SHAP يكشف عن اعتماد المُقيّم على محاذاة الكيانات المسماة ويحدد أنماط الفشل الرئيسية.

Surya Vardhan Yalavarthi2026-03-18
💬 NLP

Polyglot-Lion: Efficient Multilingual ASR for Singapore via Balanced Fine-Tuning of Qwen3-ASR

تقدم الورقة البحثية Polyglot-Lion، وهي عائلة من نماذج التعرف التلقائي على الكلام (ASR) متعددة اللغات، مدمجة ومنخفضة التكلفة للغات سنغافورة الرسمية الأربع، والتي تحقق دقة تنافسية مع أنظمة أكبر بكثير من خلال توظيف الضبط الدقيق المتوازن على نموذج Qwen3-ASR دون اشتراط لغوي صريح.

Quy-Anh Dang, Chris Ngo2026-03-18
💬 NLP

Structured Semantic Cloaking for Jailbreak Attacks on Large Language Models

تقدم الورقة البحثية إطار عمل "التخفي الدلالي المهيكل" (S2C)، وهو إطار عمل مبتكر لكسر الحماية يتجاوز آليات السلامة المتقدمة في النماذج اللغوية الكبيرة عبر تجزئة وإعادة صياغة القصد الخبيث عبر أجزاء المطالبة لتأخير إعادة البناء الدلالي، مما يحقق معدلات نجاح هجوم أعلى بكثير من الأساليب الحالية المتطورة.

Xiaobing Sun, Perry Lam, Shaohua Li, Zizhou Wang, Rick Siow Mong Goh, Yong Liu, Liangli Zhen2026-03-18
🤖 AI

Are Large Language Models Truly Smarter Than Humans?

تقدم هذه الورقة تدقيقاً صارماً متعدد الأساليب لستة نماذج لغوية كبيرة رائدة، كاشفةً أن تفوقها الظاهري على البشر في الاختبارات المرجعية العامة يتضخم بشكل كبير بسبب تلوث البيانات، مع تباين معدلات الحفظ حسب المجال وتسببها في انخفاضات جوهرية في الأداء عند اختبارها على أسئلة غير مباشرة أو معاد صياغتها.

Eshwar Reddy M, Sourav Karmakar2026-03-18
💬 NLP

SpecSteer: Synergizing Local Context and Global Reasoning for Efficient Personalized Generation

يُعد SpecSteer إطار عمل استدلال تعاوني غير متماثل يدمج بين السياق الخاص على الأجهزة مع الاستدلال واسع النطاق السحابي من خلال مسار (مسودة-تحقق-استعادة)، مما يسد بفعالية الفجوة بين الخصوصية والتوليد الشخصي عالي الجودة مع تحقيق تسريع قدره 2.36 ضعفاً.

Hang Lv, Sheng Liang, Hao Wang, Yongyue Zhang, Hongchao Gu, Wei Guo, Defu Lian, Yong Liu, Enhong Chen2026-03-18
💬 NLP

More Rounds, More Noise: Why Multi-Turn Review Fails to Improve Cross-Context Verification

على الرغم من الجاذبية الحدسية للتفاعلات متعددة الأدوار، تُظهر هذه الدراسة أن المراجعة الديناميكية عبر السياقات (D-CCR) تفشل في تحسين المراجعة عبر السياقات أحادية المرور لأن العملية التكرارية تُدخل ضجيجاً يؤدي إلى تدهور أداء التحقق.

Song Tae-Eun2026-03-18
💬 NLP

Attention-guided Evidence Grounding for Spoken Question Answering

تقدم هذه الورقة إطار عمل "تأصيل الأدلة الموجه بالانتباه" (AEG)، وهو إطار عمل متكامل لنظام الإجابة على الأسئلة المنطوقة يستخدم نموذج ضبط دقيق تحت الإشراف يسمى "التعلم للتركيز على الأدلة" (LFE) لمعايرة آليات الانتباه في النماذج اللغوية الكلامية الكبيرة (SpeechLLM)، مما يؤدي إلى تقليل الهلوسة وزمن الاستجابة عند الاستدلال بنسبة 62% مع التفوق على النماذج المتتالية المرجعية.

Ke Yang, Bolin Chen, Yuejie Li, Yueying Hua, Jianhao Nie, Yueping He, Bowen Li, Chengjun Mao2026-03-18
💬 NLP

PyPhonPlan: Simulating phonetic planning with dynamic neural fields and task dynamics

تقدم الورقة البحثية PyPhonPlan، وهي حزمة أدوات مفتوحة المصدر بلغة بايثون تحاكي التخطيط الصوتي من خلال دمج الحقول العصبية الديناميكية المقترنة مع ديناميكيات المهام لنمذجة إنتاج وإدراك الكلام بشكل تفاعلي ضمن إطار عمل قائم على الأسس العصبية ومنضبط زمنياً.

Sam Kirkham2026-03-18
🤖 machine learning

Behavioral Steering in a 35B MoE Language Model via SAE-Decoded Probe Vectors: One Agency Axis, Not Five Traits

تُثبت هذه الورقة أن تدريب المشفّرات التلقائية المتناثرة على تيار المتبقي لنموذج Qwen 3.5-35B وإسقاط أوزان المسبار مرة أخرى عبر فك التشفير يُمكّن من توجيه السلوكيات الوكيلة بدقة دون الحاجة لإعادة التدريب، مما يكشف أن الالتزامات الاستقلالية تُحسب خلال مرحلة الملء المسبق في بنيات GatedDeltaNet.

Jia Qing Yap2026-03-18