💬 NLP

PERCEPT: A Corpus for POS Tagging and Analysis of Persian-English Code-Mixing

تقدم هذه الورقة PERCEPT، وهو أول متن لغوي واسع النطاق للفارسية والإنجليزية المختلطة برمجياً والموسومة بوسوم أقسام الكلام (POS) الخاصة بـ Universal Dependencies، إلى جانب إطار عمل للترميز بمساعدة النماذج اللغوية الكبيرة (LLM) وتحليل لغوي شامل يكشف عن أنماط خاصة بالمنصات في خلط الرموز عبر وسائل التواصل الاجتماعي.

Ghazal Kalhor, Zahra Jafari, Amirarsalan Shahbazi, Behnam Bahrak2026-08-12
🤖 machine learning

Procedural Fairness Failures in RLHF from Preference Averaging

تحدد هذه الورقة أن التعلم المعزز القياسي من التغذية الراجعة البشرية (RLHF) يفشل في تحقيق العدالة الإجرائية عبر متوسط التفضيلات غير المتجانسة، مما يتسبب في هيمنة مجموعات الأغلبية على تعلم المكافأة، وتقترح "التعلم المعزز من التفضيلات الواعية" (PA-RLHF) لفصل التحسين عبر أنماط التفضيل، مما يحسن دقة المحاذاة بشكل كبير ويقلل فجوات العدالة.

M P V S Gopinadh, Karthik Kamuju, Kummari Avinash, John Joshua, Srinivasa Raju Rudraraju2026-08-12
💬 NLP

Edge Phoneme Recognition for Children's Speech through Age-Aware Training

تقدم هذه الورقة استراتيجية تدريب مدركة للعمر لنموذج حافة خفيف الوزن يتنبأ بكل من الفونيمات وعمر المتحدث، مما يمكّن نظاماً بـ 94 مليون معلمة من التفوق على نماذج WavLM Large الأكبر في التعرف على كلام الأطفال مع تسهيل التطبيقات التي تحافظ على الخصوصية وتعمل على الأجهزة مثل PhonemeTrainer.

Matthew Arboleda, Ryan Arboleda, Sophie Haak, Sam Hjelmeset, Andrew Franck, Bingrui Yang, Jose Bustamante Ortiz, Yuanron (…)2026-08-12
💬 NLP

TAF-MED: Multi-Turn Safety Refusal Collapse in LLMs Under Declared Self-Treatment Intent

تقدم الورقة البحثية TAF-MED، وهو معيار مراجع من قبل أطباء يوضح أن النماذج اللغوية الكبيرة غالباً ما تنهار من الاستجابات الآمنة الأولية إلى نصائح طبية غير آمنة في المحادثات متعددة الأدوار، مما يكشف أن تقييمات السلامة في الدور الأول ليست مؤشرات كافية لسلامة المحادثة الإجمالية.

Waleed Jamil, Raphael Schmitt2026-08-12
🤖 machine learning

Power law graph attention: exact generalization of scaled dot-product attention, empirical collapse at inference

تقدم هذه الورقة انتباه الرسم البياني ذو قانون القوة (PLGA)، وهو تعميم مؤصل نظرياً لانتباه حاصل الضرب النقطي المقيّس يستبدل الأشكال ثنائية الخطية الثابتة بمعاملات تعلمية موجبة قائمة على الموتر، مع إثبات نظرية انهيار الاستدلال التي تحد من ميزته العملية لتصل إلى أداء شبه متطابق تحت ظروف محددة.

Burc Gokden2026-08-12
💬 NLP

Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility

تقدم هذه الورقة "الاتساق عبر السياقات" (C3)، وهو مقياس يقيم مصداقية النماذج اللغوية الكبيرة من خلال قياس استقرار استجابات النموذج تحت التغيرات السياقية، مما يثبت أن الاتساق الأعلى يرتبط بدقة أكبر ويعمل كأداة تشخيصية لتشبع الاختبارات المعيارية.

Siyang Wu, Yibo Jiang, Bryon Aragam2026-08-12
💬 NLP

Who Gets Heeded? An Obligation-Level Audit of Responsiveness in EPA Rulemaking

تقدم هذه الورقة إطاراً للتدقيق على مستوى الالتزام مدعوماً بالذكاء الاصطناዊ لتحليل عملية صياعة القواعد التنظيمية لوكالة حماية البيئة، كاشفةً أنه في حين يؤثر المشاركة العامة بشكل طفيف على المراجعات التنظيمية، فإن عدم التماثل الأساسي في العدالة لا يكمن في اتجاه التعليقات، بل في القدرة المتفاوتة لمجموعات المعلقين على تحديد والاعتراض على التزامات قانونية محددة، وهو استنتاج تعززه نتيجة اكتشاف أن أساليب تشابه النصوص غير كافية للتمييز بين التغييرات التنظيمية الجوهرية وبين التحسينات التحريرية.

Jianing Fan, Yue Yao2026-08-12
💬 NLP

Narrative Keyframing for Generative Creative Writing

تقدم هذه الورقة "التأطير السردي المفتاحي"، وهي تقنية كتابة إبداعية مدعومة بالذكاء الاصطناًعي مستوحاة من الرسوم المتحركة، تتيح للكُتّاب تحديد قيود الحبكة والشخصية والمنظور في لحظات قصصية محددة لتوليد النثر البيني، مما يوفر بذلك سير عمل أكثر تحكماً وشفافية وتفاعلية للسرد القصصي التكراري.

Chao Zhang, Abe Davis2026-08-12
💬 NLP

VoxSumm: A Multilingual Corpus of Long-Form Spoken News for Joint Summarization and Translation

تقدم الورقة البحثية VoxSumm، وهو متن لغوي متعدد اللغات يضم أكثر من 10,000 زوج من مقالات بي بي سي وملخصاتها يمتد عبر 24 لغة و703 ساعات من الكلام، لإنشاء أول معيار لمهام التلخيص والترجمة المشتركة للكلام (JSumT) وتقييم أداء نماذج الكلام واللغة الحالية في هذه المهمة.

Yejin Jeon, Marie Maltais, Virginia Ceccatelli, Min Ma, David Ifeoluwa Adelani2026-08-12
💬 NLP

DSAgentBench: Can Agents Automate End-to-End Data-Science Workflows in Real Computer Environments?

تقدم هذه الورقة DSAgentBench، وهو أول معيار مصمم لتقييم قدرة وكلاء الذكاء الاصطناعي على أتمتة سير عمل علم البيانات من البداية إلى النهاية ضمن بيئات حاسوبية حقيقية، مما يكشف عن فجوة أداء كبيرة حيث تواجه حتى أقوى النماذح صعوبة في تنسيق الأدوات والاستنتاج متعدد الخطوات.

Mizanur Rahman, Mohammed Saidul Islam, Ridwan Mahbub, Md Tahmid Rahman Laskar, Shafiq Joty, Enamul Hoque Prince2026-08-12