💬 NLP

AMEL: Accumulated Message Effects on LLM Judgments

تقدم هذه الورقة البحثية "تأثيرات الرسائل المتراكمة على أحكام النماذج اللغوية الكبيرة" (AMEL)، مبرهنةً على أن النماذج اللغوية الكبيرة المستخدمة كمقيمين تظهر انحيازاً كبيراً نحو القطبية السائدة في تاريخ المحادثة السابق — لا سيما عند عدم اليقين أو التعرض لسياقات سلبية — بغض النظر عن حجم النموذج أو طول التاريخ، مما يوصي باستخدام سياقات جديدة أو تاريخ متوازن لضمان التقييم الآلي الموثوق.

Sid-ali Temkit2026-05-22
💬 NLP

AnyMo: Geometry-Aware Setup-Agnostic Modeling of Human Motion in the Wild

إنّ AnyMo هو إطار عمل مدرك للهندسة وغير مرتبط بإعدادات محددة، يستفيد من محاكاة وحدة قياس القصور الذاتي (IMU) القائمة على الفيزياء والمواءمة مع النماذج اللغوية الكبيرة (LLM) لتمكين فهم قوي ومعمم لحركة الإنسان عبر مختلف الأجهزة القابلة للارتداء ومجموعات البيانات غير المرئية، متفوقاً بشكل كبير على الطرق الحالية في التعرف على الأنشطة في وضع الصفر، والاسترجاع متعدد الوسائط، ووصف الحركة.

Baiyu Chen, Zechen Li, Wilson Wongso, Lihuan Li, Xiachong Lin, Hao Xue, Benjamin Tag, Flora Salim2026-05-22
⚡ electrical engineering

Beyond Acoustic Emotion Recognition: Multimodal Pathos Analysis in Political Speech Using LLM-Based and Acoustic Emotion Models

تُثبت هذه الورقة أن التحليل متعدد الوسائط القائم على النماذج اللغوية الكبيرة يتفوق على نماذج التعرف على العواطف الصوتية التقليدية في التقاط البعد الدلالي لـ "الباثوس" (Pathos) في الخطاب السياسي، مع تسليط الضوء على قيود كبيرة في المعايير الصوتية القياسية بسبب الكلام الممثل والتحيزات الثقافية.

Juergen Dietrich2026-05-22
💬 NLP

ChronoMedKG: A Temporally-Grounded Biomedical Knowledge Graph and Benchmark for Clinical Reasoning

تقدم هذه الورقة ChronoMedKG، وهو رسم بياني معرفي طبي حيوي مرتبط زمنياً تم بناؤه عبر مسار نماذج لغوية كبيرة متعددة الوكلاء يقوم بترميز الارتباطات المرضية المعتمدة على الوقت مع مصداقية مدعومة بالأدلة، إلى جانب معيار ChronoTQA الذي يثبت أن دمج هذه البيانات الزمنية يحسن بشكل كبير الاستدلال السريري وتوليد المحتوى المعزز بالاسترجاع للنماذج اللغوية الكبيرة الرائدة مقارنة بمصادر المعرفة الثابتة.

Md Shamim Ahmed, Farzaneh Firoozbakht, Lukas Galke Poech, Jan Baumbach, Richard Röttger2026-05-22
💬 NLP

Reducing Political Manipulation with Consistency Training

تقدم هذه الورقة البحثية تدريب الاتساق السياسي (PCT)، وهو أسلوب للتعلم المعزز يستخدم مقاييس اتساق المشاعر والمساعدة لتقليل الانحياز السياسي الخفي في النماذج اللغوية الكبيرة بفعالية مع الحفاظ على قدرتها الإجمالية على المساعدة.

Long Phan, Devin Kim, Alexander Pan, Alice Blair, Adam Khoja, Dan Hendrycks2026-05-22
💬 NLP

Evaluating Commercial AI Chatbots as News Intermediaries

تقيم هذه الورقة ستة من برامج الدردشة الآلية التجارية القائمة على الذكاء الاصطناعي عبر 2,100 سؤال من الأخبار الآنية بست لغات، كاشفةً أنه في حين تحقق هذه البرامج دقة عالية في الاستعلامات جيدة الصياغة، إلا أنها تعاني من تحيزات إقليمية كبيرة، وإخفاقات تعتمد على عملية الاسترجاع، وهشاشة شديدة تجاه المقدمات الخاطئة مما يقوض موثوقيتها كوسيط إخباري.

Mirac Suzgun, Emily Shen, Federico Bianchi, Alexander Spangher, Thomas Icard, Daniel E. Ho, Dan Jurafsky, James Zou2026-05-22
💬 NLP

Vector Policy Optimization: Training for Diversity Improves Test-Time Search

تقدم الورقة البحثية "تحسين السياسة المتجهية" (VPO)، وهو خوارزمية للتعلم المعزز تدرب النماذج اللغوية على توليد حلول متنوعة من خلال الاستفادة من المكافآت ذات القيم المتجهية، مما يحسن أداءها بشكل كبير في إجراءات البحث في وقت الاختبار مقارنة بتحسين المكافأة القياسية القياسية.

Ryan Bahlous-Boldi, Isha Puri, Idan Shenfeld, Akarsh Kumar, Mehul Damani, Sebastian Risi, Omar Khattab, Zhang-Wei Hong (…)2026-05-22
💬 NLP

Tokenisation via Convex Relaxations

تقدم هذه الورقة ConvexTok، وهي خوارزمية لتقطيع النصوص (tokenization) مبتكرة تصيغ بناء المفردات كبرنامج خطي يمكن حله عبر الأمثلة المحدبة، مما يجعلها تتفوق على الطرق الجشعة التقليدية في المقاييس الجوهرية وكفاءة النماذج اللغوية مع توفير حد معتمد على مدى قربها من المثالية.

Jan Tempus, Philip Whittington, Craig W. Schmidt, Dennis Komm, Tiago Pimentel2026-05-22
💬 NLP

A Systematic Comparison between Extractive Self-Explanations and Human Rationales in Text Classification

تقارن هذه الورقة بشكل منهجي بين التفسيرات الذاتية الاستخراجية من النماذج اللغوية الكبيرة المضبوطة بالتعليمات وبين المبررات البشرية عبر مهام متعددة لتصنيف النصوص، وتجد أنه بينما يعتمد التوافق بين الاثنين على طول النص وتعقيد المهمة، فإن التفسيرات الذاتية توفر رؤى وفية على مستوى الرموز تختلف جوهرياً عن التركيز الهيكلي لطرق العزو اللاحقة.

Stephanie Brandl, Oliver Eberle2026-05-21
💬 NLP

Toxic Subword Pruning for Dialogue Response Generation on Large Language Models

تقدم هذه الورقة البحثية ToxPrune، وهو خوارزمية مبتكرة وفعالة تعمل على تقليم الكلمات الفرعية المرتبطة بالمفردات السامة من النماذج اللغوية الكبيرة المدربة، مما يمنع توليد المحتوى السام بفعالية مع تعزيز تنوع الحوار والأداء في الوقت ذاته، دون التكاليف العالية أو المخاطر المرتبطة بعمليات محاذاة السلامة التقليدية القائمة على الأوزان.

Hongyuan Lu, Wai Lam2026-05-21