⚡ electrical engineering

Task-Lens: Cross-Task Utility Based Speech Dataset Profiling for Low-Resource Indian Languages

تقدم هذه الورقة "Task-Lens"، وهي مسح شامل متعدد المهام يستعرض 50 مجموعة بيانات صوتية هندية عبر 26 لغة وتسع مهام تالية لتحديد البيانات الوصفية غير المستغلة، واقتراح التحسينات، وتسليط الضوء على الفجوات الحرجة في موارد تكنولوجيا الكلام منخفضة الموارد.

Swati Sharma, Divya V. Sharma, Anubha Gupta2026-03-02
💬 NLP

FHIRPath-QA: Executable Question Answering over FHIR Electronic Health Records

تقدم هذه الورقة FHIRPath-QA، وهي مجموعة بيانات ومعيار مفتوح يتيح الإجابة الآمنة والفعالة على الأسئلة المتعلقة بحالات مرضية محددة عبر السجلات الصحية الإلكترونية من خلال نقل استدلال النماذج اللغوية الكبيرة من توليد النصوص الحرة إلى تركيب استعلامات FHIRPath القابلة للتنفيذ.

Michael Frew, Nishit Bheda, Bryan Tripp2026-03-02
💬 NLP

Humans and LLMs Diverge on Probabilistic Inferences

تقدم هذه الورقة ProbCOPA، وهي مجموعة بيانات من الاستدلالات الاحتمالية المشروحة بأحكام بشرية، لتوضيح أن نماذج اللغات الكبيرة المتطورة في مجال الاستدلال تفشل باستمرار في محاكاة الطبيعة المتدرجة والمتنوعة للاستدلال الاحتمالي البشري، مما يسلط الضوء على فجوة حرجة في تقييم النماذج بما يتجاوز المهام الحتمية.

Gaurav Kamath, Sreenath Madathil, Sebastian Schuster, Marie-Catherine de Marneffe, Siva Reddy2026-03-02
💬 NLP

France or Spain or Germany or France: A Neural Account of Non-Redundant Redundant Disjunctions

تقدم هذه الورقة تفسيراً عصبياً لعمليات الفصل غير المكررة الحساسة للسياق، حيث تُثبت من خلال الأدلة السلوكية وتحليل النماذج اللغوية أن تجنب التكرار ينشأ من التفاعل بين الربط السياقي للمفردات المعجمية المتكررة والانتباه الانتقائي بواسطة رؤوس الاستقراء في نماذج المحولات (Transformer induction heads).

Sasha Boguraev, Qing Yao, Kyle Mahowald2026-03-02
💬 NLP

LFQA-HP-1M: A Large-Scale Human Preference Dataset for Long-Form Question Answering

تقدم هذه الورقة البحثية LFQA-HP-1M، وهي مجموعة بيانات ضخمة تضم 1.3 مليون تعليق بشري حول التفضيلات للإجابة على الأسئلة طويلة الصيغة، إلى جانب إطار عمل قائم على معايير تقييم يُمكّن النماذج الخطية البسيطة من مضاهاة أفضل نماذج اللغات الكبيرة (LLMs) المستخدمة في التقييم، مع تسليط الضوء على نقاط ضعف الأخيرة تجاه الانحيازات والهجمات العدائية.

Rafid Ishrak Jahan, Fahmid Shahriar Iqbal, Sagnik Ray Choudhury2026-03-02
💬 NLP

LLM-Driven Multi-Turn Task-Oriented Dialogue Synthesis for Realistic Reasoning

تقترح هذه الورقة إطار عمل مدفوعاً بالنماذج اللغوية الكبيرة (LLM) يستخدم التحسين ثلاثي المستويات لتخليق حوارات واقعية متعددة الأدوار موجهة نحو المهام، ومهام استدلال مُحسّنة تكرارياً، مما يعالج أوجه القصور في المعايير المرجعية الحالية في تقييم وتعزيز قدرات الاستدلال المنطقي للنماذج اللغوية الكبيرة.

Yu Zhu, Kai Yang2026-03-02
💬 NLP

TRIZ-RAGNER: A Retrieval-Augmented Large Language Model for TRIZ-Aware Named Entity Recognition in Patent-Based Contradiction Mining

تقترح هذه الورقة البحثية TRIZ-RAGNER، وهو إطار عمل لنموذج لغوي كبير مدعوم بالاسترجاع يدمج الاسترجاع الكثيف والتحفيز المهيكل عبر قاعدة معرفة TRIZ لتحسين دقة واتساق استخراج أزواج التناقضات من نصوص براءات الاختراع بشكل كبير، متفوقاً بذلك على النهج القائمة على القواعد، والتعلم الآلي التقليدي، ونماذج اللغات الكبيرة القياسية.

Zitong Xu, Yuqing Wu, Yue Zhao2026-03-02
💬 NLP

From Static Benchmarks to Dynamic Protocol: Agent-Centric Text Anomaly Detection for Evaluating LLM Reasoning

تقترح هذه الورقة نموذجاً معيارياً متمحوراً حول الوكلاء يستبدل مجموعات البيانات الثابتة ببروتوكول ديناميكي يتضمن وكلاء مستقلين (معلم، ومنسق، وطالب) لتوليد والتحقق من وحل مشكلات كشف الشذوذ النصي بشكل تكراري، مما يتيح تقييماً تصاعدياً وقابلاً للتوسع لقدرات الاستدلال في النماذج اللغوية الكبيرة التي تكشف عن أخطاء الحالات الحدية التي تغفل عنها المعايير التقليدية.

Seungdong Yoa, Sanghyu Yoon, Suhee Yoon, Dongmin Kim, Ye Seul Sim, Junhyun Lee, Woohyung Lim2026-03-02
💬 NLP

Divide and Conquer: Accelerating Diffusion-Based Large Language Models via Adaptive Parallel Decoding

تقدم هذه الورقة DiCo، وهو إطار عمل فك ترميز متوازي تكيفي يسد الفجوة بين التوازي النظري والعملي في النماذج اللغوية الكبيرة القائمة على الانتشار عبر توظيف استراتيجية "فرق تسد" ثلاثية المراحل لتحقيق تسريع كبير في الاستنتاج دون المساس بجودة التوليد.

Xiangzhong Luo, Yilin An, Zhicheng Yu, Weichen Liu, Xu Yang2026-03-02
💬 NLP

CLFEC: A New Task for Unified Linguistic and Factual Error Correction in paragraph-level Chinese Professional Writing

تقدم هذه الورقة CLFEC، وهي مهمة ومجموعة بيانات جديدة للتصحيح الموحد للأخطاء اللغوية والواقعية في الكتابة المهنية الصينية، مُظهرةً من خلال تجارب منهجية قائمة على النماذج اللغوية الكبيرة أن التصحيح المشترك يتفوق على النهج المنفصل، ومسلطةً الضيأ على فعالية سير العمل القائم على الوكلاء لبناء أنظمة تدقيق لغوي آلي موثوقة.

Jian Kai, Zidong Zhang, Jiwen Chen, Zhengxiang Wu, Songtao Sun, Fuyang Li, Yang Cao, Qiang Liu2026-03-02