💬 NLP

Learning from Fine-Grained Visual Discrepancies: Mitigating Multimodal Hallucinations via In-Context Visual Contrastive Optimization

تقترح هذه الورقة البحثية "التحسين التبايني البصري داخل السياق" (IC-VCO)، وهو إطار عمل دقيق رياضياً معزز بالتقطير التبايني البصري وتوليد العينات السلبية الصعبة بدقة، للحد بفعالية من الهلوسة متعددة الوسائط في نماذج الرؤية واللغة عبر معالجة أوجه القصور في أساليب التفضيل البصري الحالية.

Haolin Deng, Xin Zou, Zhiwei Jin, Chen Chen, Haonan Lu, Xuming Hu2026-06-01
💬 NLP

Reinforcement Learning Amplifies Emergent Misalignment from Harmless Rewards

تُظهر هذه الورقة أن التعلم التعزيزي يضخم عدم التوافق الناشئ في النماذج اللغوية الصغيرة ذات الأوزان المفتوحة بشكل أكثر حدة من الضبط الدقيق الخاضع للإشراف، حتى عندما يتم تحفيزه بواسطة إشارات مكافأة طبيعية معقولة، ولكنها تُبين أن استراتيجيات التخفيف الحالية مثل تداخل بيانات السلامة تظل فعالة.

Magnus Jørgenvåg, David Kaczér, Lasse Ruttert, Marvin Gülhan, Lucie Flek, Florian Mai2026-06-01
💬 NLP

Bundesrecht: An Open Library and Corpus for German Statutory Reference Processing

تقدم هذه الورقة البحثية **bundesrecht**، وهي مكتبة بايثون مفتوحة المصدر ومتن مهيكل يوفران أول مسار عمل متكامل (end-to-end) لتحليل وتطبيع وحل المراجع التشريعية الألمانية، بدءاً من سلاسل الاستشهاد الخام وصولاً إلى نصوص قانونية محددة.

Harshil Darji, Martin Heckelmann, Christina Kratsch, Gerard de Melo2026-06-01
💬 NLP

FBHM: Functional Benchmarking and Steering of VLMs for Hateful Meme Detection

تقدم هذه الورقة البحثية FBHM، وهو معيار مرجعي جديد يكشف أن نماذج الرؤية واللغة المتطورة تفشل في التعميم على كشف الميمات التي تنطوي على خطاب كراهية بسبب الاعتماد على الاستدلالات الخاصة بمجموعات البيانات، وتقترح LSV، وهي طريقة متجه توجيه منخفضة البيانات تعمل على تحسين الأداء بشكل كبير من خلال تطبيق التدخلات السببية.

Paramananda Bhaskar, Naquee Rizwan, Daksh Jogchand, Saurabh Kumar Pandey, Animesh Mukherjee2026-06-01
💬 NLP

The Latin Substrate: How Language Models Represent and Mediate Script Choice

تكشف هذه الورقة أن النماذج اللغوية الكبيرة تتوسط اختيار الخطوط من خلال تمثيلات كامنة مشتركة وآليات غير مرتبطة بلغة محددة، مُظهرةً عدم تماثل هيكلي حيث يتم التحكم في الخطوط غير اللاتينية بواسطة مكونات محددة في الطبقات المتأخرة، بينما يبرز الخط اللاتيني كركيزة افتراضية متميزة ومنتشرة.

Daniil Gurgurov, Alan Saji, Katharina Trinley, Josef van Genabith, Simon Ostermann2026-06-01
💬 NLP

Unlocking Fine-Grained Translation Quality Estimation in LRMs through Synergistically Evolving Implicit and Explicit Reasoning

تقترح الورقة البحثية إطار عمل RIEQE، وهو إطار تدريب ثنائي المراحل يعمل على تطوير قدرات الاستدلال الضمني والصريح بشكل تآزري في نماذج الاستدلال اللغوية الكبيرة لتحسين جودة تقدير الترجمة دقيقة التفاصيل بشكل كبير.

Renfei Dang, Xinye Wang, Zhejian Lai, Weilu Xu, Shimin Tao, Daimeng Wei, Min Zhang, Shujian Huang2026-06-01
💬 NLP

LLM Judges Inconsistently Disagree Across Safety Criteria and Harm Categories

تكشف هذه الورقة أن النماذج اللغوية الكبيرة المستخدمة كحكام آليين تظهر عدم اتساق وعدم موثوقية كبيرين، لا سيما عند تقييم المجالات المنظمة مثل التمويل أو التباين حسب اللغة والمعايير، مما يسلط الض_ الضوء على الحاجة إلى التنفيذ الدقيق في تقييمات السلامة.

Krishnapriya Vishnubhotla, Soumya Vajjala, Akriti Vij, Isar Nejadgholi2026-06-01
💬 NLP

Target-Side Paraphrase Augmentation for Sign Language Translation with Large Language Models

تقترح هذه الورقة طريقة لتعزيز إعادة الصياغة من جانب الهدف باستخدام GPT-4o لتوليد متغيرات محكومة للجمل المرجعية لتدريب نماذج ترجمة لغة الإشارة، مما أظهر تحسناً في درجات BLEU والأمانة الدلالية على مجموعة بيانات PHOENIX14T مع تسليط الضوء على قيود النهج في البيانات شديدة التكرار أو الشحيحة للغاية.

Pedro Dal Bianco, Jean Paul Nunes Reinhold, Oscar Stanchi, Facundo Quiroga, Franco Ronchetti, Ulisses Brisolara Corrêa2026-06-01
💬 NLP

"Intelegi Româneste?'' A Recipe for Romanian Vision-Language Models

تقدم هذه الورقة دراسة منهجية حول بناء نماذج رؤية-لغة خاصة باللغة الرومانية من خلال ترجمة مجموعات النصوص الإنجليزية، وتنسيق معيار HoraVQA المرتكز ثقافياً، وإثبات أن النماذج المتكيفة مع ركائز اللغة الرومانية تتفوق على النظراء متعددي اللغات الأكبر حجماً عبر جميع المهام التي تم تقييمها.

Mihai Masala, Marius Leordeanu, Mihai Dascalu, Traian Rebedea2026-06-01
💬 NLP

Neuro-symbolic Syntactic Parsing: Shaping a Neural Network with the CYK Algorithm

تقدم هذه الورقة البحثية CYKNN، وهي بنية شبكة عصبية متكررة مبتكرة تدمج خوارزمية كوك-يانجر-كاسامي (CYK) للتحليل النحوي مباشرة في عمليات المصفوفة والمتجه القابلة للتدريب، مما يظهر أداءً فائقاً على كل من نماذج التعلم داخل السياق الكبيرة والنماذج اللغوية الكبيرة الأصغر حجماً والمعدلة بدقة في مهام التحليل النحوي.

Fabio Massimo Zanzotto, Federico Ranaldi, Giorgio Satta2026-06-01