⚡ electrical engineering

Benchmarking Automatic Speech Recognition for Indian Languages in Agricultural Contexts

تضع هذه الورقة إطاراً مرجعياً للتعرف التلقائي على الكلام في السياقات الزراعية عبر لغات الهندي والتيلجو والأوديا، حيث تقدم مقاييس خاصة بالمجال وتثبت أن تقسيم المتحدثين يحسن الأداء بشكل كبير، مع تسليط الضوء على تحديات اللغات ذات الموارد المنخفضة وجودة الصوت الميداني.

Chandrashekar M S, Vineet Singh, Lakshmi Pedapudi2026-02-09
💬 NLP

Back to Basics: Revisiting Exploration in Reinforcement Learning for LLM Reasoning via Generative Probabilities

تقترح هذه الورقة ProGRPO، وهو نهج جديد للتعلم التعزيزي يستخدم آلية إعادة وزن الميزة (Advantage Re-weighting Mechanism) للتخفيف من حدة انهيار النمط (mode collapse) وتعزيز الاستكشاف في استدلال النماذج اللغوية الكبيرة عبر إعادة تشكيل إشارات المكافأة ديناميكيًا لموازنة الثقة عبر الحلول الصحيحة المتنوعة، مما يؤدي إلى تحسين كل من الدقة والتنوع التوليدي بشكل كبير في معايير الاختبار الرياضية والبرمجية.

Pengyi Li, Elizaveta Goncharova, Andrey Kuznetsov, Ivan Oseledets2026-02-09
💬 NLP

Causal Front-Door Adjustment for Robust Jailbreak Attacks on LLMs

تقترح هذه الورقة هجوم تعديل الباب الأمامي السببي (CFA²)، وهو إطار عمل مبتكر لكسر الحماية يعمل على نمذجة آليات السلامة كعوامل مربكة غير ملاحظة ويستخدم المشفّرات التلقائية المتفرقة لتجريد ميزات الدفاع عبر معيار الباب الأمامي لبيرل، محققاً معدلات نجاح هجوم هي الأفضل حالياً مع تعقيد منخفض في الاستدلال.

Yao Zhou, Zeen Song, Wenwen Qiang, Fengge Wu, Shuyi Zhou, Changwen Zheng, Hui Xiong2026-02-09
💬 NLP

A Human-in-the-Loop, LLM-Centered Architecture for Knowledge-Graph Question Answering

تقدم هذه الورقة إطار عمل تفاعلياً يعتمد على وجود الإنسان في الحلقة، والذي يسخر النماذج اللغوية الكبيرة لتوليد وشرح استعلامات "سايفر" (Cypher) للرسوم البيانية المعرفية، مما يمكّن المستخدمين من صقل الطلبات المكتوبة باللغة الطبيعية بشكل تكراري لتحقيق إجابات دقيقة وقابلة للتفسير وصارمة عبر مجالات متنوعة.

Larissa Pusch, Alexandre Courtiol, Tim Conrad2026-02-09
💬 NLP

SAGE: Benchmarking and Improving Retrieval for Deep Research Agents

تقدم الورقة البحثية SAGE، وهو معيار مرجعي يكشف أن أدوات الاسترجاع القائمة على النماذج اللغوية الكبيرة (LLMs) تؤدي أداءً أقل من الطرق التقليدية القائمة على الكلمات المفتاحية في وكلاء البحث العميق بسبب عدم التوافق في توليد الاستعلامات، وتقترح إطار عمل للتوسع عند وقت الاختبار على مستوى المتن يعزز أداء الاسترجاع بشكل كبير من خلال تعزيز المستندات ببيانات وصفية مولدة بواسطة النماذج اللغوية الكبيرة.

Tiansheng Hu, Yilun Zhao, Canyu Zhang, Arman Cohan, Chen Zhao2026-02-09
💬 NLP

Recontextualizing Famous Quotes for Brand Slogan Generation

تقترح هذه الورقة إطار عمل نموذجياً يعيد سياق الاقتباسات الشهيرة لتوليد شعارات تجارية مبتكرة ومتوافقة مع شخصية العلامة التجارية، مما يعالج التكرار الأسلوبي للنهج الحالي القائم على النماذج اللغوية الكبيرة، ويُظهر أداءً محسناً في التنوع والابتكار والتأثير العاطفي من خلال تقييمات مكثفة.

Ziao Yang, Zizhang Chen, Lei Zhang, Hongfu Liu2026-02-09
💬 NLP

Relevance-aware Multi-context Contrastive Decoding for Retrieval-augmented Visual Question Answering

تقترح هذه الورقة البحثية طريقة فك ترميز تعتمد على الوعي بالارتباط (RMCD)، وهي طريقة فك ترميز خالية من التدريب تعمل على تعزيز الإجابة على الأسئلة البصرية المعززة بالاسترجاع عبر وزن سياقات متعددة مسترجعة بشكل تكيفي بناءً على صلتها، وذلك لتجميع المعلومات المفيدة بفعالية مع كبح الضجيج الناتج عن المصادر غير ذات الصلة.

Jongha Kim, Byungoh Ko, Jeehye Na, Jinsung Yoon, Hyunwoo J. Kim2026-02-09
💬 NLP

Analyzing Diffusion and Autoregressive Vision Language Models in Multimodal Embedding Space

تقدم هذه الورقة أول دراسة منهجية تقارن بين نماذج اللغة الانتشارية متعددة الوسائط ونماذج اللغة الرؤيوية ذات التوليد الذاتي كأدوات تضمين، كاشفةً أنه في حين تظهر النماذج الأولى أداءً أقل بشكل عام بسبب عدم كفاية المحاذاة بين الصورة والنص، فإن فجوة الأداء تتباين بشكل كبير بين نماذج محددة.

Zihang Wang, Siyue Zhang, Yilun Zhao, Jingyi Yang, Tingyu Song, Anh Tuan Luu, Chen Zhao2026-02-09
💬 NLP

Uncertainty Drives Social Bias Changes in Quantized Large Language Models

تكشف هذه الدراسة أن التكميم ما بعد التدريب يغير بشكل جذري التحيزات الاجتماعية للنماذج اللغوية الكبيرة من خلال عملية "قلب التحيز المقنع" المدفوع بعدم اليقين، مما يتسبب في تحولات ديموغرافية كبيرة وغير متماثلة تظل غير مكتشفة بواسطة المقاييس الإجمالية رغم التغيرات الجوهرية في الاستجابات الفردية.

Stanley Z. Hua, Sanae Lotfi, Irene Y. Chen2026-02-09
💬 NLP

PhenoLIP: Integrating Phenotype Ontology Knowledge into Medical Vision-Language Pretraining

تقدم الورقة البحثية PhenoLIP، وهو إطار عمل جديد للتدريب المسبق للرؤية واللغة الطبية يستفيد من رسم بياني معرفي واسع النطاق متمحور حول الأنماط الظاهرية (PhenoKG) واستراتيجية تقطير معرفي موجهة من قبل معلم لتعزيز أداء التعرف على الأنماط الظاهرية والاسترجاع عبر الوسائط بشكل كبير مقارنة بالنماذج الحالية ذات الحالة الفنية المتطورة.

Cheng Liang, Chaoyi Wu, Weike Zhao, Ya Zhang, Yanfeng Wang, Weidi Xie2026-02-09