💬 NLP

AccentBox: Towards High-Fidelity Zero-Shot Accent Generation

تقترح هذه الورقة AccentBox، وهو إطار عمل مبتكر من مرحلتين يعتمد على تقنية "الصفر استباقي" (zero-shot) لتوحيد تحويل اللهجات الأجنبية، وتحويل النص إلى كلام بلهجة (accented TTS)، وتحويل النص إلى كلام بنمط الصفر استباقي (ZS-TTS)، وذلك لتحقيق توليد لهجات عالي الدقة وتحكم عالٍ عبر تكييف نظام تحويل النص إلى كلام بناءً على تضمينات لهجة مستقلة عن المتحدث مستمدة من نموذج تحديد لهجات متطور.

Jinzuomu Zhong, Korin Richmond, Zhiba Su, Siqi Sun2026-02-06
💬 NLP

Invisible Walls in Cities: Designing LLM Agent to Predict Urban Segregation Experience with Social Media Content

تقترح هذه الورقة وكيلًا جديدًا يعتمد على النماذج اللغوية الكبيرة (LLM) مجهزًا بمبرمج تأملي وإطار عمل للتفكير والتمثيل (RE'EM) لاستخراج مراجعات وسائل التواصل الاجتماعي تلقائيًا، وتوليد دليل ترميز قابل للتعميم لأبعاد الفصل الحضري، وتحسين التنبؤ بالفصل التجريبي بشكل كبير مع تعزيز الفهم البشري للشمولية الاجتماعية.

Bingbing Fan, Lin Chen, Songwei Li, Jian Yuan, Fengli Xu, Pan Hui, Yong Li2026-02-06
💬 NLP

Pairwise Evaluation of Accent Similarity in Speech Synthesis

تقترح هذه الورقة طرق تقييم محسنة للتشابه في اللهجات في مجال تركيب الكلام، حيث تقدم اختبار استماع XAB منقحاً ومقاييس قائمة على النطق، مع تسليط الضوء على أوجه القصور في المقاييس القياسية مثل معدل الخطأ في الكلمات بالنسبة للهجات غير الممثلة كفاية.

Jinzuomu Zhong, Suyuan Liu, Dan Wells, Korin Richmond2026-02-06
💬 NLP

POLAR: A Benchmark for Multilingual, Multicultural, and Multi-Event Online Polarization

تقدم هذه الورقة POLAR، وهي مجموعة بيانات مرجعية شاملة متعددة اللغات والثقافات للاستقطاب عبر الإنترنت، وتقيم قدرات النماذج اللغوية المختلفة، كاشفةً عن أنه في حين يمكنها اكتشاف الاستقطاب، إلا أنها تواجه صعوبة في المهام المعقدة المتمثلة في تحديد أنواع وتجليات محددة له.

Usman Naseem, Robert Geislinger, Juan Ren, Sarah Kohail, Rudy Garrido Veliz, P Sam Sahil, Yiran Zhang, Marco Antonio Str (…)2026-02-06
💬 NLP

Verifying the Verifiers: Unveiling Pitfalls and Potentials in Fact Verifiers

تقيم هذه الدراسة 13 نموذجاً للتحقق من الحقائق عبر 14 معياراً، كاشفةً أن أخطاء ترميز مجموعات البيانات تؤدي إلى تحيز التصنيفات بشكل كبير، وأن النماذج اللغوية الكبيرة الرائدة في التعلم من أمثلة قليلة تتفوق على أدوات التحقق المتخصصة، كما يمكن تعزيز النماذج الصغيرة التي خضعت للضبط الدقيق من أجل الاستنتاج المعقد عبر بيانات اصطناعية متعددة الخطوات.

Wooseok Seo, Seungju Han, Jaehun Jung, Benjamin Newman, Seungwon Lim, Seungbeen Lee, Ximing Lu, Yejin Choi, Youngjae Yu2026-02-06
💬 NLP

STACK: Adversarial Attacks on LLM Safeguard Pipelines

تقدم هذه الورقة إجراء هجوم STACK، الذي نجح في اختراق خط دفاع نموذج لغوي كبير (LLM) يعتمد على توجيهات قليلة الأمثلة (few-shot-prompted) بنسبة نجاح هجوم بلغت 71%، مما يسلط الضوء على ثغرات حرجة في أنظمة الدفاع الحالية للذكاء الاصطناعي الرائد ويقترح تدابير تخفيف محددة.

Ian R. McKenzie, Oskar J. Hollinsworth, Tom Tseng, Xander Davies, Stephen Casper, Aaron D. Tucker, Robert Kirk, Adam Gle (…)2026-02-06
💬 NLP

Segmentation-free Goodness of Pronunciation

تقترح هذه الورقة طرقاً لجودة النطق خالية من التجزئة (GOP-SA و GOP-SF) تستفيد من النماذج الصوتية المدربة باستخدام تقنية CTC للتغلب على قيود ما قبل التجزئة في اكتشاف سوء النطق، محققةً بذلك نتائج هي الأفضل في مجالها في تقييم النطق على مستوى الفونيم.

Xinwei Cao, Zijian Fan, Torbjørn Svendsen, Giampiero Salvi2026-02-06
💬 NLP

GTPO and GRPO-S: Token and Sequence-Level Reward Shaping with Policy Entropy

تقدم هذه الورقة البحثية GTPO وGRPO-S، وهما خوارزميتان جديدتان للتعلم التعزيزي تعملان على تعزيز استدلال النماذج اللغوية الكبيرة من خلال تنفيذ تشكيل مكافأة ديناميكي قائم على الإنتروبيا لتحقيق تخصيص دقيق للمسؤولية (credit assignment) على مستوى الرمز (token-level) ومستوى التسلسل (sequence-level)، مما يتغلب على القيود ذات الحبيبات الخشنة التي تعاني منها الأساليب الحالية مثل GRPO وDAPO.

Hongze Tan, Zihan Wang, Jianfei Pan, Jinghao Lin, Hao Wang, Yifan Wu, Tao Chen, Zhihang Zheng, Zhihao Tang, Haihua Yang2026-02-06
💬 NLP

When Are Two RLHF Objectives the Same?

تقدم هذه الورقة Opal، وهي خوارزمية لتوحيد الصيغ (canonicalization) تحدد التكافؤ الجبري لأهداف تفضيلات التعلم المعزز من التغذية الراجعة البشرية (RLHF)، كاشفةً أن العديد من الأساليب المستخدمة على نطاق واسع هي في الواقع إعادة تمثيل لنفس الهدف الأساسي، مع تحديد الآليات الهيكلية المحددة التي تخلق أهدافاً متميزة حقاً.

Madhava Gaikwad2026-02-06
💬 NLP

Patterns in the Transition From Founder-Leadership to Community Governance of Open Source

من خلال تحليل 637 مستودعاً من مستودعات "غيت هاب" (GitHub) ووثائق حوكمتها المتطورة، تكشف هذه الدراسة أن الانتقالات الناجحة من الحوكمة التي يقودها المؤسس إلى حوكمة المجتمع لا تحدث عبر تحولات في النبرة، بل من خلال التراكم التدريجي والتحسين للأدوار المؤسسية واللوائح على مستوى النظام البيئي.

Mobina Noori, Mahasweta Chakraborti, Amy X Zhang, Seth Frey2026-02-06