💬 NLP

'Ghaib in Translation' aka Unseen Harm: Measuring Cross-Script Safety Inconsistency with 'Missed-in-Urdu' Scores in LLM Hate Speech Detection

تكشف هذه الورقة أن النماذج اللغوية الكبيرة تظهر عدم اتساق ملحوظ في السلامة ومعدلات "فشل في الرصد باللغة الأردية" عند اكتشاف خطاب الكراهية بالأردية عبر مختلف النصوص، مما يسلط الضوء على فجوة حرجة في موثوقية الإشراف على المحتوى ناتجة عن الغياب التام للغة الأردية في وقائع أبحاث سلامة الذكاء الاصطناي في تسع سنوات من الأبحىث الرئيسية.

Fawzia Zehra (Fuzzy), Kara-Isitt, Sonal Khosla, Stephen Swift2026-08-26
💬 NLP

RecurSE: Bounded Recursive Self-Evaluation for LLM Rubric Judges

يقدم RecurSE إطاراً للتقييم الذاتي المتكرر المحدود يُمكّن قضاة النماذج اللغوية الكبيرة من التحسن من خلال مكافآت ذاتية التوليد مغلقة الحلقة، وذلك عبر الفصل الهيكلي بين الاستدلال التقييمي والأحكام، واستخدام فاحص متزامن مع مراقبة صلاحية الميزة الزوجية لمنع التدهور وضمان التعميم الموثوق دون إشراف خارجي.

Kaiyuan Liu, Ziyuan Zhuang, Rongxiang Weng, Jieping Ye2026-08-26
💬 NLP

ROBE: Reversed-Order-Biased-Experts for Extracting Extreme Long-tail Events from Historical Texts

تقدم الورقة البحثية إطار عمل ROBE (الخبراء المنحازون لترتيب عكسي)، وهو إطار عمل مبتكر يجمع بين مصنفات الخبراء الموزونة بالأولوية والبيانات الاصطناعية الخاصة بمجال معين لتحسين استخراج الأحداث التاريخية النادرة وطويلة الذيل من النصوص الهولندية في القرنين السابع عشر والثامن عشر بشكل كبير، متفوقاً بذلك على النماذج القياسية المضبوطة بدقة في درجات الدقة والاستدعاء ومقياس F1.

Stella Verkijk, Piek Vossen2026-08-26
🤖 AI

RePolicy: Reinforcement Learning for Safety-Policy Invocation in Agent Safeguards

تقدم الورقة البحثية RePolicy، وهو وكيل حماية قائم على التعلم التعزيزي يستدعي ديناميكياً سياسات سلامة محددة السياق لإنشاء أحكام سلامة مستندة إلى أسس واقعية، مما يظهر قدرة فائقة على التكيف وأداءً في الكشف عبر معايير متنوعة مقارنة بطرق التلقين والضبط الدقيق الحالية.

Houcheng Jiang, Boxuan Zhang, Qiyong Zhong, Junfeng Fang, Xiang Wang, Xiangnan He2026-08-26
⚡ electrical engineering

Speech-to-SOAP: End-to-End Summarization of Medical Dialogues: KIT@BeTraC 2026

تقدم هذه الورقة مشاركة معهد كارلسروه للتكنولوجيا (KIT) في تحدي BeTraC 2026، حيث تقدم خط معالجة لتعزيز البيانات قابل للتوسع يوحد مجموعات البيانات الطبية غير المتجانسة عبر الكلام الاصطناعي وإشراف SOAP المُنشأ تلقائياً لتمكين تلخيص قوي ومباشر من الكلام إلى تقارير SOAP دون الحاجة إلى نصوص وسيطة.

Enes Yavuz Ugan, Fabian Retkowski, Yuka Ko, Thai-Binh Nguyen, Maike Züfle, Jan Niehues, Alexander Waibel2026-08-26
💬 NLP

SeMoCo: A Semantic-First Motion Codec for Motion Language Modeling

تقدم الورقة البحثية SeMoCo، وهو ترميز حركة يعتمد على الدلالة أولاً يقوم بفصل رموز الحركة إلى مكونات دلالية وحركية لتحسين كل من دقة إعادة البناء وتوليد الحركة المشروط باللغة، جنباً إلى جنب مع إنشاء مجموعة بيانات Ω\Omega-MotionVerse واسعة النطاق.

Tianlv Huang, Hetian Guo, Ziyi Cai, Song Wang, Yanping Zhang, Zipei Fan, Xuan Song, Guangming Wu, Xin Zheng2026-08-26
💬 NLP

FARCA: Fact-Aligned Reliability-Aware Credit Assignment for Reinforcement Learning with Factual Supervision

إنَّ FARCA هو إطار عمل لتحسين السياسات يعمل على التخفيف من الهلوسة في التعلم التعزيزي باستخدام الإشراف الواقعي، وذلك عبر تفكيك تعيين الائتمان الضوضائي إلى غموض في التحديد وغموض في الموثوقية، مما يولد إشارات تدريبية دقيقة المستوى وموزونة بالموثوقية تعمل على تحسين واقعية النموذج دون المساس بقدرات الاستدلال العام.

Qiming Xie, Wenjie Zheng, Xiangqing Shen, Rui Xia2026-08-26
💬 NLP

Words, Spaces and Generative AI: Layers of language in contemporary architecture

تجادل هذه الورقة بأن اللغة تعمل كمادة تصميمية حاسمة في العمارة المعاصرة، لا سيما مع صعود الذكاء الاصطناذ التوليدي، وذلك من خلال تحليل التفاعل بين الخطاب، ولغات البرمجة، والتعليقات التوضيحية لاقتراح أجندة بحثية تربط النظريات اللغوية بممارسات التصميم الحاسوبي.

Anca-Simona Horvath2026-08-26
💬 NLP

Shortcut Before Circuit: Document Statistics Time In-Context Conflict Resolution

تُظهر هذه الورقة أنه عندما يكون الارتباط بين مؤشرات الحداثة والندرة تاماً في بيانات التدريب، فإن الشبكات العصبية تتعلم استراتيجيات غير متمايزة لحل الصراعات داخل السياق، مما يكشف أن العزو الآلي غير متاح جوهرياً حتى يتم تجاوز عتبة تكرار محددة، والتي عندها يهرب النموذج من الاختصارات الموضعية ويصبح الآلية الكامنة قابلة للتحديد.

Yijun Liao, Fanwei Liang2026-08-26
💬 NLP

UTS at CheckThat! 2026: Cite-Frame Engineering for Generated Fact-Checking Articles

حقق نظام UTS المركز الثاني في مهمة CheckThat! 2026 الثالثة عبر توظيف مولد قائم على قوالب حتمية معزز بإطار استشهاد ذي عزو نطاقي ومحدد مرساة مُتحقق منه بظلال، وكلاهما يستفيد من نموذج لغوي كبير صغير لغرض التحقق من الاستشهاد حصراً وليس لتوليد النثر لتعظيم درجات الاستلزام والتغطية.

Dima Galat, Marian-Andrei Rizoiu2026-08-26