💬 NLP

BM25-Augmented Many-Shot Translation for Low-Resource North-Eastern Indian Languages

تقدم هذه الورقة البحثية مشاركة جامعة فلوريدا غيتورز في مسابقة WMT26، والتي تستخدم خط معالجة للترجمة يعتمد على الاسترجاع المعزز بالنماذج متعددة الأمثلة (many-shot) باستخدام تقنية BM25 لجلب أمثلة متوازية ذات صلة ونموذج Gemini 2.5 Flash للاستدلال، محققةً ترجمة للغة الإنجليزية لإحدى عشرة لغة من شمال شرق الهند دون أي ضبط دقيق للنموذج.

Aashish Dhawan, Christopher Driggers-Ellis, Dzmitry Kasinets, Christan Grant, Daisy Zhe Wang2026-08-17
💬 NLP

GALA: Generation-Aware Cross-Modal Alignment for Text-to-Time-Series Synthesis

يقدم GALA إطار عمل جديداً ذا مرحلتين يحقق أداءً هو الأفضل في فئته في مجال توليد السلاسل الزمنية من النصوص عبر توظيف محاذاة عابرة للأنماط مدركة للتوليد لإنشاء تضمينات وصفية مُحسّنة خصيصاً لتوجيه مولدات مطابقة التدفق، مما يؤدي في آن واحد إلى تحسين دقة الإشارة والالتزام بالنص.

Haochen Zhang, Gengwei Zhang, Laura Yao, Nicholas Knoz, Tianlong Chen2026-08-17
💬 NLP

Amplified Does Not Mean Predictive: Reasoning Behaviors in Thinking Models

تكشف هذه الورقة عن "فجوة تضخيم-رفع" (Amplification-Lift Gap) جوهرية في نماذج الاستدلال، حيث يعمل التدريب على تضخيم السلوكيات التأملية مثل التصحيح الذاتي والإقرار بعدم اليقين، وهي سلوكيات لا تتنبأ بالضرورة بالصحة، بينما يفشل في تعزيز السلوكيات عالية القيمة بشكل كافٍ مثل معايرة الثقة ومواءمة المعرفة.

Jean de Dieu Nyandwi, Leena Mathur, Yonatan Bisk, Robert Hawkins, Graham Neubig2026-08-17
💬 NLP

Do AI chatbots find what experts would? Effects of model, user role, and sample size on study retrieval for medical questions

تقيم هذه الدراسة ثلاثة من روبوتات الدردشة القائمة على النماذج اللغوية الكبيرة في الإجابة على الأسئلة الطبية، وتجد أن أداء الاسترجاع يتباين بشكل كبير حسب النموذج ودور المستخدم، مع تفوق ChatGPT على غيره، وإظهار جميع النماذح انحيازاً نحو الاستشهاد بالتجارب السريرية الأكبر.

Qingfang Liu, Qiao Jin, Joe D. Menke, Thorsten Kahnt, Zhiyong Lu2026-08-17
🤖 AI

From Passive Delegates to Strategic Negotiators: Reinforcing Social Reasoning in Small Language Models with SocialRL

تقدم الورقة البحثية SocialRL، وهي وصفة تدريبية تحول النماذج اللغوية الصغيرة إلى مفاوضين استراتيجيين عبر تعزيز التفكير الاجتماعي وسقالات نظرية العقل، مما يمكّن نموذجاً بـ 4 مليارات معلمة من مضاهاة أو تجاوز أداء النماذج الرائدة الأكبر بكثير مثل GPT-5 عبر استراتيجيات التدريب داخل النطاق والنقل عبر النطاقات في مجالات تفاوض متنوعة.

Wenyue Hua, Zachary Huang, Tyler Payne, Safoora Yousefi, Saleema Amershi, Asli Celikyilmaz2026-08-17
💬 NLP

ASSERT: A Measurement Pipeline for GenAI Audits

تقدم الورقة البحثية ASSERT، وهي مسار قياس قائم على المواصفات لتدقيق الذكاء الاصطناً التوليدي يربط صراحةً معدلات الامتثال المُبلغ عنها بخيارات القياس الكامنة وراءها، مما يوضح كيف تؤثر التباينات في تصميم التدقيق — مثل إعداد الحوار أو معايير التقييم — بشكل كبير على تصنيفات الأنظمة وقابليتها للتفسير.

Riccardo Fogliato, Abhinav Palia, Xiawei Wang, Emily Sheng, Chad Atalla, Jean Garcia-Gathright, Nicholas Pangakis, Sharm (…)2026-08-17
🤖 machine learning

Geometric Filtering of LLM-Generated Samples for Few-Shot Text Classification

تقترح هذه الورقة إطار عمل للترشيح الهندسي يعمل على تحسين التصنيف النصي قليل العينات من خلال اختيار العينات الاصطناعية المولدة بواسطة النماذج اللغوية الكبيرة بناءً على مسافتها الإقليدية من أمثلة الفئات الحقيقية في فضاء التضمين، محققةً مكاسب كبيرة في الأداء مقارنة بالطرق الحالية مثل SMOTE عبر مجموعات بيانات ونماذج متنوعة.

Benjamín Schindler, Gonzalo A. Ruz2026-08-17
🤖 machine learning

CForce: Boosting Parallel Decoding for dLLMs via Consistency Forcing

تقدم هذه الورقة البحثية CForce، وهي طريقة تقطير لفرض الاتساق تعمل على تحسين المقايضة بين السرعة والجودة لنماذج الانتشار اللغوية الكبيرة من خلال محاذاة تنبؤات القناع في المراحل المبكرة مع عمليات الصقل في المراحل اللاحقة عبر هدف تباعد كولباك-لايبلر (KL divergence) جديد متكيف مع الثقة.

Yuji Ren, Chenkai Xu, Zhuocheng Gong, Jianguo Li, Zhijie Deng2026-08-17
🤖 AI

Never the Number: Structural Abstention for AI Systems Whose Answers Are Consumed as Fact

تقترح هذه الورقة "الامتناع الهيكلي"، وهو نمط معماري لأنظمة الذكاء الاصطناعي يفصل بين غلاف توليدي ونواة حتمية لضمان رفض الطلبات غير القابلة للإجابة أو الغامضة صراحةً بدلاً من الهلوسة، مما يضمن الموثوقية الواقعية في عمليات النشر المؤسسية والوكيلة.

Zhelun (Allen), Wu2026-08-17
💬 NLP

Scaling Creative Writing Beyond Story-Centric Data with Attribute-Guided Genre Expansion

تقدم هذه الورقة إطار عمل لتوسيع الأنواع الأدبية بتوجيه من السمات، والذي يعمل على توسيع نطاق بيانات الكتابة الإبداعية بما يتجاوز القصص عبر الجمع بين المطالبات البشرية وسمات النوع المنسقة لإنتاج مجموعة متعددة الأنواع مكونة من 50 ألف مثال، مما يعزز بشكل كبير قدرة النماذج اللغوية الكبيرة على إتقان التنسيقات الإبداعية المتنوعة والاصطلاحات الهيكلية.

Hwan Chang, Yongil Kim, Heuiyeen Yeen, Yireun Kim, Jinsik Lee, Hwanhee Lee2026-08-17