💬 NLP

Bootstrapping Audiovisual Speech Recognition in Zero-AV-Resource Scenarios with Synthetic Visual Data

تقترح هذه الورقة إطار عمل بصفر من الموارد السمعية البصرية للتعرف على الكلام السمعي البصري، والذي يقوم بتوليد فيديوهات لرؤوس متحدثة اصطناعية عبر مطابقة حركة الشفاه لصور وجه ثابتة مع صوت حقيقي، مما يُمكّن بنجاح من تدريب نماذج عالية الأداء للغات ذات الموارد المحدودة مثل الكتالونية دون الحاجة إلى مجموعات بيانات فيديو مصنفة.

Pol Buitrago, Pol Gàlvez, Oriol Pareras, Javier Hernando2026-03-10
💬 NLP

How Much Do LLMs Hallucinate in Document Q&A Scenarios? A 172-Billion-Token Study Across Temperatures, Context Lengths, and Hardware Platforms

تستخدم هذه الدراسة تقييماً ضخماً يمتد عبر 172 مليار توكن عبر نماذج وأطوال سياق وأجهزة عتادية متنوعة لتكشف أنه في حين أن اختيار النموذج هو المحدد الرئيسي للدقة، فإن معدلات الهلوسة في أسئلة وأجوبة المستندات ترتفع بشكل ملحوظ مع طول السياق وتتفاوت بشكل غير خطي مع درجة الحرارة، مما يسلط الض الضوء على أن القدرة على الاستناد إلى المراجع ومقاومة التزييف هما قدرتان متمايزتان.

JV Roig2026-03-10
💬 NLP

AdaCultureSafe: Adaptive Cultural Safety Grounded by Cultural Knowledge in Large Language Models

تقترح الورقة البحثية AdaCultureSafe، وهو إطار عمل يعالج عدم الارتباط بين السلامة الثقافية والمعرفة في النماذج اللغوية الكبيرة من خلال بناء مجموعة بيانات جديدة من الاستعلامات ذات الأسس الثقافية وتقديم طريقة متكاملة المعرفة لتعزيز السلامة الثقافية التكيفية بشكل كبير.

Hankun Kang, Di Lin, Zhirong Liao, Pengfei Bai, Xinyi Zeng, Jiawei Jiang, Yuanyuan Zhu, Tieyun Qian2026-03-10
💬 NLP

Evaluating LLM-Based Grant Proposal Review via Structured Perturbations

تُقيّم هذه الورقة مراجعات مقترحات المنح القائمة على النماذج اللغوية الكبيرة باستخدام اضطرابات هيكلية على ستة محاور للجودة، لتجد أن نهج التحليل "قسمًا بقسم" يتفوق على البنيات الأخرى، لكن النماذج الحالية لا تزال تعاني في اكتشاف الوضوح والتقييم الشمولي، مما يشير إلى أنها الأنسب كأدوات تكميلية بدلاً من أن تكون بدائل للمراجعين البشر.

William Thorne, Joseph James, Yang Wang, Chenghua Lin, Diana Maynard2026-03-10
💬 NLP

LAMUS: A Large-Scale Corpus for Legal Argument Mining from U.S. Caselaw using LLMs

تقدم هذه الورقة LAMUS، وهو متن لغوي ضخم وعالي الجودة لاستخراج الحجج القانونية على مستوى الجمل من السوابق القضائية الأمريكية، تم بناؤه عبر مسار عمل مدفوع بالنماذج اللغوية الكبيرة مع تنقيح بشري، مما يثبت أن التلقين بسلسلة الأفكار والتحقق بمساعدة النماذج اللغوية الكبيرة يعززان بشكل كبير جودة التوسيم وأداء النماذج لأبحاث معالجة اللغات الطبيعية القانونية المستقبلية.

Serene Wang, Lavanya Pobbathi, Haihua Chen2026-03-10
🤖 machine learning

Rethinking Attention Output Projection: Structured Hadamard Transforms for Efficient Transformers

تقترح هذه الورقة استبدال إسقاط المخرجات الكثيف في الانتباه متعدد الرؤوس بتحويل "والش-هادامارد" الخالي من المعلمات وإعادة قياس تآلفي خفيف الوزن، مما يحقق تخفيضات كبيرة في عدد المعلمات والذاكرة وزمن انتقال الاستدلال مع الحفاظ على أداء النموذج أو تحسينه عبر مختلف الاختبارات القياسية.

Shubham Aggarwal, Lokendra Kumar2026-03-10
💬 NLP

Do Language Models Know Theo Has a Wife? Investigating the Proviso Problem

تقدم هذه الورقة مجموعة بيانات تشخيصية وإطار تقييم لاستقصاء كيفية تعامل النماذج اللغوية مع مشكلة "الشرط المسبق" (proviso problem) في التداولية، كاشفةً أنه بينما تتماشى النماذج مع الأحكام البشرية، إلا أنها تعتمد على مطابقة الأنماط السطحية بدلاً من الاستدلال الدلالي أو التداولي الحقيقي.

Tara Azin, Daniel Dumitrescu, Diana Inkpen, Raj Singh2026-03-10
💬 NLP

COACH meets QUORUM: A Framework and Pipeline for Aligning User, Expert and Developer Perspectives in LLM-generated Health Counselling

تقدم هذه الورقة QUORUM، وهو إطار تقييم موحد، وCOACH، وهو مسار عمل مدفوع بالنماذج اللغوية الكبيرة، لتوليد وتقييم الاستشارات الصحية المخصصة لمرضى السرطان، مما يثبت أنه بينما يتفق أصحاب المصلحة على صلة النظام وجودته، فإنهم يختلفون في تفاصيل دقيقة مثل النبرة والحساسية تجاه الأخطاء، مما يسلط الضوء على الحاجة الماسة للتقييم متعدد المنظور في أنظمة معالجة اللغات الطبيعية الموثوقة والمتمحورة حول المريض.

Yee Man Ng, Bram van Dijk, Pieter Beynen, Otto Boekesteijn, Joris Jansen, Gerard van Oortmerssen, Max van Duijn, Marco S (…)2026-03-10
🤖 machine learning

Revealing Behavioral Plasticity in Large Language Models: A Token-Conditional Perspective

تقدم هذه الورقة البحثية "التعلم المعزز المشروط بالرموز" (ToCoRL)، وهو إطار عمل يستفيد من اللدونة السلوكية الجوهرية للنماذج اللغوية الكبيرة لاستيعاب وتثبيت التكيفات أثناء وقت الاستدلال، مما يتيح التحكم الدقيق في الأنماط السلوكية مثل الانتقال من التفكير إلى الإجابة المباشرة دون تدهور القدرات العامة.

Liyuan Mao, Le Yu, Jing Zhou, Chujie Zheng, Bowen Yu, Chang Gao, Shixuan Liu, An Yang, Weinan Zhang, JunYang Lin2026-03-10
💬 NLP

Sandpiper: Orchestrated AI-Annotation for Educational Discourse at Scale

تقدم الورقة البحثية "ساندبيبر" (Sandpiper)، وهو نظام ذو مبادرة مختلطة يدمج لوحات تحكم تفاعلية للباحثين مع نماذج لغوية كبيرة وكيلية لتمكين تحليل نوعي واسع النطاق، يحافظ على الخصوصية ويتسم بالدقة للخطاب التعليمي ضخم الحجم، مع الحد من الهلوسة وضمان الاتساق المنهجي.

Daryl Hedley, Doug Pietrzak, Jorge Dias, Ian Burden, Bakhtawar Ahtisham, Zhuqian Zhou, Kirk Vanacore, Josh Marland, Rach (…)2026-03-10