💬 NLP

Stop Fixating on Prompts: Reasoning Hijacking and Constraint Tightening for Red-Teaming LLM Agents

تقدم هذه الورقة JailAgent، وهو إطار عمل جديد للاختبار الأحمر يتجاوز تعديل مطالبات المستخدم لمهاجمة وكلاء النماذج اللغوية الكبيرة عبر الاختطاف الضمني لمسارات استدلالهم وتشديد القيود من خلال استخراج المحفزات، والتلاعب بالاستدلال، والتحكم في استرجاع الذاكرة.

Yanxu Mao, Peipei Liu, Tiehan Cui, Congying Liu, Mingzhe Xing, Datao You2026-04-08
💬 NLP

AutoSOTA: An End-to-End Automated Research System for State-of-the-Art AI Model Discovery

يُعد AutoSOTA نظام بحث آلي متعدد الوكلاء ومتكامل من البداية إلى النهاية، نجح في إعادة إنتاج وتحسين نماذج الذكاء الاصطناٍعي ذات الأداء الأفضل (SOTA) المستمدة من أوراق بحثية رفيعة المستوى تجريبياً، حيث اكتشف 105 نماذج جديدة من فئة SOTA من خلال عملية ثلاثية المراحل تشمل إعداد الموارد، وتقييم التجارب، والتفكير القائم على التأمل.

Yu Li, Chenyang Shao, Xinyang Liu, Ruotong Zhao, Peijie Liu, Hongyuan Su, Zhibin Chen, Qinglong Yang, Anjie Xu, Yi Fang (…)2026-04-08
💬 NLP

FastDiSS: Few-step Match Many-step Diffusion Language Model on Sequence-to-Sequence Generation--Full Version

تقدم الورقة البحثية FastDiSS، وهو إطار تدريب مبتكر لنماذج اللغة الانتشارية من نوع (sequence-to-sequence)، والذي يستخدم التكييف الذاتي المضطرب والوعي بالضجيج على مستوى الرمز (token-level) للتغلب على فجوات التقريب في أخذ العينات خلال خطوات قليلة، محققاً سرعة استنتاج تصل إلى 400 ضعف مع الحفاظ على جودة توليد تنافسية.

Dat Nguyen-Cong, Tung Kieu, Hoang Thanh-Tung2026-04-08
💬 NLP

YoNER: A New Yorùbá Multi-domain Named Entity Recognition Dataset

تقدم هذه الورقة YoNER، وهي مجموعة بيانات جديدة عالية الجودة لتعرّف الكيانات المسماة متعددة المجالات للغة اليوروبا تضم 5,000 جملة عبر خمسة مجالات متنوعة، إلى جانب إطلاق النموذج اللغوي OyoBERT ومعيار مرجعي شامل يوضح تحديات التعميم عبر المجالات وتفوق النماذج المتمحورة حول أفريقيا لهذه المهمة.

Peace Busola Falola, Jesujoba O. Alabi, Solomon O. Akinola, Folashade T. Ogunajo, Emmanuel Oluwadunsin Alabi, David Ifeo (…)2026-04-08
💬 NLP

See the Forest for the Trees: Loosely Speculative Decoding via Visual-Semantic Guidance for Efficient Inference of Video LLMs

تقدم الورقة البحثية LVSpec، وهو إطار عمل لفك التشفير الاستنباطي (speculative decoding) خالٍ من التدريب لنماذج الفيديو اللغوية الكبيرة (Video-LLMs)، يستفيد من التوجيه البصري-الدلالي وتحمل إزاحة الموضع للتغلب على قيود المطابقة التامة الصارمة، محققاً تسارعاً في الاستنتاج يصل إلى 2.94 ضعفاً مع الحفاظ على أكثر من 99.8% من أداء النموذج.

Yicheng Ji, Jun Zhang, Jinpeng Chen, Cong Wang, Lidan Shou, Gang Chen, Huan Li2026-04-08
💬 NLP

LLM Reasoning as Trajectories: Step-Specific Representation Geometry and Correctness Signals

تُوصّف هذه الورقة البحثية استدلال "سلسلة الأفكار" في النماذج اللغوية الكبيرة باعتباره مسارات مهيكلة عبر فضاء التمثيل، كاشفةً عن تباعد الحلول الصحيحة والخاطئة بشكل منهجي في المراحل المتأخرة، مما يتيح التنبؤ بالدقة والتوجيه القائم على المسار من أجل التصحيح أثناء الاستدلال.

Lihao Sun, Hang Dong, Bo Qiao, Qingwei Lin, Dongmei Zhang, Saravan Rajmohan2026-04-08
💬 NLP

Dialogue Act Patterns in GenAI-Mediated L2 Oral Practice: A Sequential Analysis of Learner-Chatbot Interactions

تحلل هذه الدراسة تفاعلات استمرت لمدة 10 أسابيع بين متعلمين صينيين للغة الإنجليزية كلغة أجنبية في الصف التاسع وروبوت دردشة صوتي يعتمد على الذكاء الاصطناٍ التوليدي، حيث كشفت أن الجلسات ذات التقدم العالي تتميز بالأسئلة التي يبادر بها المتعلم والتغذية الراجعة التصحيحية القائمة على التلميح في الوقت المناسب، مما يقدم إطاراً مستنداً إلى المبادئ التربوية لتصميم روبوتات الدردشة التعليمية التكيفية لتعلم اللغة الثانية.

Liqun He (Cindy), Shijun (Cindy), Chen, Mutlu Cukurova, Manolis Mavrikis2026-04-08
💬 NLP

Controlling Distributional Bias in Multi-Round LLM Generation via KL-Optimized Fine-Tuning

تقترح هذه الورقة إطار عمل جديد للضبط الدقيق يجمع بين معايرة رمز التوجيه (Steering Token Calibration) وهدف تحسين هجين يعتمد على تباعد كيه إل (KL-divergence) ونظرية كانمان-تفيرسكي (Kahneman-Tversky)، وذلك للتحكم بفعالية في توزيعات مخرجات النماذج اللغوية الكبيرة ومواءمتها عبر جولات متعددة، مما يعالج أوجه القصور في الأساليب الحالية المتعلقة بتوليد محتوى ممثل إحصائياً فيما يخص سمات مثل النوع الاجتماعي، والعرق، والمشاعر.

Yanbei Jiang, Amr Keleg, Ryandito Diandaru, Jey Han Lau, Lea Frermann, Biaoyan Fang, Fajri Koto2026-04-08
💬 NLP

Beyond the Beep: Scalable Collision Anticipation and Real-Time Explainability with BADAS-2.0

يعمل نظام BADAS-2.0 على تطوير التنبؤ بالتصادم من خلال تقديم معيار قياسي واسع النطاق طويل الذيل للسيناريوهات النادرة الحرجة للسلامة، وتمكين النشر عند الحواف في الوقت الفعلي عبر تقطير المعرفة الفعال، وتوفير تنبؤات قابلة للتفسير عبر خرائط حرارية للاهتمام المرتكز على الكائنات والاستدلال القائم على الرؤية واللغة.

Roni Goldshmidt, Hamish Scott, Lorenzo Niccolini, Hernan Matzner2026-04-08
🧬 biology

GenomeQA: Benchmarking General Large Language Models for Genome Sequence Understanding

تقدم الورقة البحثية GenomeQA، وهو معيار مرجعي شامل يضم 5,200 عينة موزعة على ست عائلات من المهام لتقييم وتشخيص قدرات النماذج اللغوية الكبيرة العامة في فهم تسلسلات الجينوم الخام، مما يكشف عن قدرتها على الاستفادة من الإشارات المحلية مع تسليط الضوء على أوجه القصور في الاستنتاج المعقد متعدد الخطوات.

Weicai Long, Yusen Hou, Junning Feng, Houcheng Su, Shuo Yang, Donglin Xie, Yanlin Zhang2026-04-08