💬 NLP

ProGAL-VLA: Grounded Alignment through Prospective Reasoning in Vision-Language-Action Models

يعزز ProGAL-VLA نماذج الرؤية واللغة والعمل من خلال دمج رسم بياني ثلاثي الأبعاد متمحور حول الكيانات، وتخطيط الأهداف الفرعية الرمزية، وفقد التباين في محاذاة التأسيس لتحقيق وكلاء روبوتيين أقوياء وحساسين للتعليمات ومدركين للغموض يتفوقون بشكل كبير على الأساليب الحالية في التعامل مع الاضطرابات والفروق اللغوية الدقيقة.

Nastaran Darabi, Amit Ranjan Trivedi2026-04-14
🤖 AI

COMPOSITE-Stem

تقدم الورقة البحثية COMPOSITE-STEM، وهو معيار مرجعي جديد مُعد من قبل خبراء يضم 70 مهمة مفتوحة المصدر في مجالات الفيزياء والأحياء والكيمياء والرياضيات، والذي يستخدم تقييماً مرناً قائماً على نماذج التصحيح (rubric) ليكشف أن وكلاء الذكاء الاصطناعي الرائدين الحاليين لا يزالون يعانون في التفكير العلمي المعقد، حيث حققوا أعلى درجة بنسبة 21% فقط.

Kyle Waters, Lucas Nuzzi, Tadhg Looram, Alessandro Tomasiello, Ariel Ghislain Kemogne Kamdoum, Bikun Li, Damien Sileo, E (…)2026-04-14
💬 NLP

Spoiler Alert: Narrative Forecasting as a Metric for Tension in LLM Storytelling

تقدم هذه الورقة مقياس "الـ 100 نهاية" (100-Endings)، الذي يحدد كمية التوتر السردي عبر قياس تكرار إخفاقات التنبؤ في 100 نهاية قصصية محاكية للنموذج عند كل جملة، وتثبت أن هذا النهج لا يكتفي فقط بتصنيف الأدب الروائي البشري فوق القصص التي تولدها النماذج اللغوية الكبيرة بشكل صحيح (على عكس المعايير المرجعية الحالية)، بل يوجه أيضاً مسار توليد هيكلي يحسن التوتر السردي بشكل كبير مع الحفاظ على أداء مقياس EQ-Bench.

Peiqi Sui, Yutong Zhu, Tianyi Cheng, Peter West, Richard Jean So, Hoyt Long, Ari Holtzman2026-04-14
💬 NLP

Exploring Structural Complexity in Normative RAG with Graph-based approaches: A case study on the ETSI Standards

تقترح هذه الورقة وتقيم منهجية "Graph RAG" متخصصة لمعايير ETSI، حيث تُثبت أن تضمين المعلومات الهيكلية والمعجمية في فهرس الاسترجاع يعزز الأداء بشكل كبير مقارنة بالأساليب التقليدية القائمة على المتجهات لمعالجة الوثائق المعيارية المعقدة.

Aiman Al Masoud, Marco Arazzi, Simone Germani, Antonino Nocera2026-04-14
💬 NLP

Cross-Cultural Value Awareness in Large Vision-Language Models

تتقصى هذه الورقة البحثية كيفية إظهار نماذج الرؤية واللغة الكبيرة (LVLMs) لتحيزات القيم الثقافية من خلال تحليل أحكامها الأخلاقية والقيمية والسياسية عبر سياقات ثقافية مختلفة باستخدام مجموعات صور استباقية ونظرية الأسس الأخلاقية.

Phillip Howard, Xin Su, Kathleen C. Fraser2026-04-14
💬 NLP

Reproduction Beyond Benchmarks: ConstBERT and ColBERT-v2 Across Backends and Query Distributions

تُثبت هذه الورقة أنه بينما يحقق كل من ConstBERT وColBERT-v2 دقة عددية عالية في المعايير القياسية، فإن اعتمادهما البنيوي على التوزين الموحد للرموز عبر عامل MaxSim يحد بشكل أساسي من متانتهما في الاستعلامات السردية الطويلة ويجعلهما شديدي الحساسية لمعلمات الخلفية ونطاق البيانات، مما يثبت أن التكيف وحده لا يمكنه التغلب على قيود استرجاع المتجهات المتعددة المتأصلة هذه.

Utshab Kumar Ghosh, Ashish David, Shubham Chatterjee2026-04-14
💬 NLP

CoSToM:Causal-oriented Steering for Intrinsic Theory-of-Mind Alignment in Large Language Models

تقدم الورقة البحثية إطار عمل CoSToM، الذي يعزز قدرات "نظرية العقل" الجوهرية لدى النماذج اللغوية الكبيرة عبر استخدام التتبع السببي لتحديد الطبقات الداخلية الحرجة وتطبيق توجيه التنشيط المستهدف لمواءمة المعرفة الداخلية مع سلوكيات الاستدلال الاجتماعي المستقرة وعالية الجودة.

Mengfan Li, Xuanhua Shi, Yang Deng2026-04-14
💬 NLP

Linguistic Accommodation Between Neurodivergent Communities on Reddit:A Communication Accommodation Theory Analysis of ADHD and Autism Groups

تطبق هذه الدراسة نظرية التكيف التواصل مع بيانات من موقع "ريديت"، كاشفةً أن مجتمعات اضطراب نقص الانتباه مع فرط النشاط (ADHD) والتوحد تحافظ على سمات لغوية متميزة تتحول في اتجاهات متعاكسة عندما يتفاعل أعضاؤها عبر المجموعات، مما يشير إلى أن التكيف مع الجمهور وعمليات الهوية يعملان من خلال آليات مختلفة.

Saad Mankarious, Nour Zein, Iyad Ait Hou, Aya Zirikly2026-04-14
💬 NLP

ASPIRin: Action Space Projection for Interactivity-Optimized Reinforcement Learning in Full-Duplex Speech Language Models

تقدم الورقة البحثية ASPIRin، وهو إطار عمل جديد للتعلم التعزيزي يقوم بفصل توقيت الكلام عن توليد المحتوى عبر "إسقاط فضاء العمل" (Action Space Projection) لتحسين تبادل الأدوار والاستجابات التفاعلية (backchanneling) في نماذج الكلام ثنائية الاتجاه (full-duplex)، مع منع التدهور الدلالي والتكرار الشائع في النهج القياسية.

Chi-Yuan Hsiao, Ke-Han Lu, Yu-Kuan Fu, Guan-Ting Lin, Hsiao-Tsung Hung, Hung-yi Lee2026-04-14
💬 NLP

Who Wrote This Line? Evaluating the Detection of LLM-Generated Classical Chinese Poetry

تقدم هذه الورقة البحثية "ChangAn"، وهو معيار شامل يتكون من أكثر من 30,000 قصيدة صينية كلاسيكية، لتقييم مدى فعالية أدوات الكشف عن الذكاء الاصطناعي الحالية في التمييز بين الشعر المكتوب بواسطة البشر والأعمال المولدة بواسطة النماذج اللغوية الكبيرة، مما يكشف عن قصور كبير في أدوات الكشف الموجودة لهذا المجال الأدبي المحدد.

Jiang Li, Tian Lan, Shanshan Wang, Dongxing Zhang, Dianqing Lin, Guanglai Gao, Derek F. Wong, Xiangdong Su2026-04-14