💬 NLP

SPARTA: Scalable and Principled Benchmark of Tree-Structured Multi-hop QA over Text and Tables

تقدم هذه الورقة SPARTA، وهو إطار عمل قابل للتوسع ومنهجي يقوم تلقائياً بتوليد معايير قياسية لأسئلة وأجوبة الجداول والنصوص واسعة النطاق وعالية الدقة، تتضمن استدلالاً عميقاً متعدد الخطوات وعمليات تجميع معقدة، مما يكشف عن فجوات أداء كبيرة في النماذج الحالية المتطورة مقارنة بالمعايير القياسية الموجودة.

Sungho Park, Jueun Kim, Wook-Shin Han2026-02-27
⚡ electrical engineering

A Mixture-of-Experts Model for Multimodal Emotion Recognition in Conversations

تقترح الورقة البحثية إطار عمل MiSTER-E، وهو إطار عمل معياري يعتمد على "خليط من الخبراء" (Mixture-of-Experts) يعمل على فصل نمذجة السياق الخاصة بكل نمط عن دمج الأنماط المتعددة باستخدام نماذج لغوية كبيرة (LLMs) مضبوطة بدقة لكل من الكلام والنص، محققاً أداءً هو الأفضل في فئته على ثلاثة مجموعات بيانات مرجعية للتعرف على العواطف دون الاعتماد على هوية المتحدث.

Soumya Dutta, Smruthi Balaji, Sriram Ganapathy2026-02-27
💬 NLP

Scale Can't Overcome Pragmatics: The Impact of Reporting Bias on Vision-Language Reasoning

تجادل هذه الورقة بأن قيود الاستنتاج في نماذج الرؤية واللغة تنبع من انحياز التقرير في بيانات التدريب التي تغفل المعلومات الضمنية، مما يثبت أن مجرد زيادة حجم النماذج أو البيانات لا يمكن أن يتغلب على هذه المشكلة، وأن التقييم المتعمد للتعليقات التوضيحية التي تلتقط مثل هذه التفاصيل ضروري للتحسين.

Amita Kamath, Jack Hessel, Khyathi Chandu, Jena D. Hwang, Kai-Wei Chang, Ranjay Krishna2026-02-27
💬 NLP

The Dark Side of ChatGPT: Legal and Ethical Challenges from Stochastic Parrots and Hallucination

تجادل هذه الورقة بأنه في حين أن الاتحاد الأوروبي رائد في تنظيم الذكاء الاصطناعي، فإن نموذجه الحالي يقلل من تقدير المخاطر القانونية والأخلاقية التي تفرضها "هلوسات" النماذج اللغوية الكبيرة وسلوكيات "الببغاء العشوائي"، مما يستلزم تطوراً إضافياً للتخفيف بفعالية من هذه التحديات الناشئة.

Zihao Li2026-02-26
💬 NLP

Emergence of a phonological bias in ChatGPT

تُظهر هذه الورقة أن ChatGPT يُبدي انحيازاً صوتياً يشبه الانحياز البشري من خلال تفضيله استخدام الحروف الساكنة على الحروف المتحركة لتحديد الكلمات عبر لغات مختلفة، مما يشير إلى أن مثل هذه السمات المعرفية يمكن أن تبرز في النماذج اللغوية الكبيرة رغم اختلاف آليات تدريبها مقارنة بالاكتساب اللغوي البشري.

Juan Manuel Toro2026-02-26
💬 NLP

Breaking the HISCO Barrier: Automatic Occupational Standardization with OccCANINE

تقدم هذه الورقة OccCANINE، وهي أداة مفتوحة المصدر تم ضبطها بدقة باستخدام 15.8 مليون زوج من البيانات متعددة اللغات، تعمل على أتمتة عملية ربط الأوصاف الوظيفية بتصنيف HISCO وأنظمة التصنيف الأخرى بدقة تصل إلى 96%، مما يحل محل الترميز اليدوي البطيء ويسهل الوصول إلى بيانات مهنية عالية الجودة للبحوث الاقتصادية.

Christian Møller Dahl, Torben Johansen, Christian Vedel2026-02-26
💬 NLP

PACE: Procedural Abstractions for Communicating Efficiently

تقدم الورقة البحثية PACE، وهو إطار عمل عصبي رمزي يجمع بين تعلم المكتبات، والتواصل العصبي، وخوارزميات "بانديت" (bandit) لتمكين الوكلاء الاصطناعيين من تطوير تجريدات إجرائية فعالة تشبه البشر للتواصل الموجه نحو المهام بشكل تعاوني.

Jonathan D. Thomas, Andrea Silvi, Devdatt Dubhashi, Moa Johansson2026-02-26
💬 NLP

Renaissance: Investigating the Pretraining of Vision-Language Encoders

تقدم هذه الورقة "رينيسانس" (Renaissance)، وهو إطار تقييم مرن للرؤية واللغة، لتوضيح أنه من خلال التحليل التلوي أن تجميد أجزاء كبيرة من النماذج أثناء التدريب المسبق يقلل بشكل كبير من تكاليف الحوسبة مع تأثير ضئيل على الأداء، وللتحقيق في آثار تهيئة نماذج المحولات للرؤية واللغة إما من نماذج الرؤية أو نماذج النصوص.

Clayton Fields, Casey Kennington2026-02-26
💬 NLP

MathFimer: Enhancing Mathematical Reasoning by Expanding Reasoning Steps through Fill-in-the-Middle Task

تقدم الورقة البحثية MathFimer، وهو إطار عمل مبتكر يعزز القدرة على الاستنتاج الرياضي للنماذج اللغوية الكبيرة من خلال تدريبها على إعادة بناء الخطوات الوسيطة المفقودة عبر مهمة "الملء في المنتصف"، مما يؤدي إلى توليد مجموعات بيانات موسعة تحسن الأداء في معايب مثل GSM8K وMATH دون الاعتماد على نماذج خارجية قوية أو تكاليف حوسبة عالية.

Yuchen Yan, Yongliang Shen, Yang Liu, Jin Jiang, Xin Xu, Mengdi Zhang, Jian Shao, Yueting Zhuang2026-02-26
💬 NLP

VOILA: Evaluation of MLLMs For Perceptual Understanding and Analogical Reasoning

تقدم هذه الورقة البحثية VOILA، وهو معيار ديناميكي يقيم قدرة النماذج اللغوية الكبيرة متعددة الوسائط على إجراء الاستدلال العلائقي التجريدي من خلال القياسات البصرية، مما يكشف أن النماذج الحالية تعاني بشكل كبير في العلاقات بين الصور مقارنة بالأداء البشري رغم التحسينات الناتجة عن استراتيجيات التلقين متعدد الخطوات.

Nilay Yilmaz, Maitreya Patel, Yiran Lawrence Luo, Tejas Gokhale, Chitta Baral, Suren Jayasuriya, Yezhou Yang2026-02-26