💬 NLP

Scaling Embeddings Outperforms Scaling Experts in Language Models

تُثبت هذه الورقة أن توسيع أبعاد التضمين يمكن أن يكون وسيلة أكثر كفاءة لتحقيق التناثر ومكاسب الأداء من توسيع نماذج خليط الخبراء (MoE)، وهو اكتشاف تم التحقق من صحته من خلال تقديم LongCat-Flash-Lite، وهو نموذج عالي الأداء بـ 68.5 مليار معلمة مع حد أدنى من تكاليف التنشيط.

Hong Liu, Jiaqi Zhang, Chao Wang, Xing Hu, Linkun Lyu, Jiaqi Sun, Xurui Yang, Bo Wang, Fengcun Li, Yulei Qian, Lingtong (…)2026-02-12
💬 NLP

Evaluating ChatGPT on Medical Information Extraction Tasks: Performance, Explainability and Beyond

تقيم هذه الورقة أداء ChatGPT عبر أربع مهام لاستخراج المعلومات الطبية، وتجد أنه بينما يقدم تفسيرات عالية الجودة ويظل أميناً للنصوص المصدرية، إلا أنه يقل أداءً مقارنة بالنماذج التي تم ضبطها بدقة ويعاني من الثقة المفرطة وعدم اليقين في التوليد.

Liz Li, Wei Zhu2026-02-12
💬 NLP

Industrialized Deception: The Collateral Effects of LLM-Generated Misinformation on Digital Ecosystems

تقدم هذه الورقة مساراً تجريبياً يتكون من أداتين جديدتين، JudgeGPT وRogueGPT، لدراسة الإدراك البشري للمعلومات المضللة الناتجة عن الذكاء الاصطناعي وتقييم سباق التسلح المستمر بين النماذج التوليدية واستراتيجيات الكشف.

Alexander Loth, Martin Kappes, Marc-Oliver Pahl2026-02-12
💬 NLP

Bias Beyond Borders: Political Ideology Evaluation and Steering in Multilingual LLMs

تقدم هذه الورقة تقييماً واسع النطاق متعدد اللغات للتحيز السياسي عبر 50 دولة و33 لغة، إلى جانب إطار عمل مبتكر للتخفيف من حدته يسمى "توجيه المحاذاة عبر اللغات" (CLAS)، والذي يقلل من التحيز الأيديولوجي من خلال محاذاة التمثيلات الكامنة عبر اللغات مع الحفاظ على جودة الاستجابة.

Afrozah Nadeem, Agrima Seth, Mehwish Nasim, Usman Naseem2026-02-12
💬 NLP

TABES: Trajectory-Aware Backward-on-Entropy Steering for Masked Diffusion Models

يقدم TABES تقنية التوجيه بالرجوع إلى الإنتروبيا (BoE)، وهو إطار استدلال موجه بالتدرج يستخدم تمريرة خلفية واحدة وآلية انتباه متفرقة لتقليل عدم اليقين المستقبلي في نماذج الانتشار المقنعة، مما يوفر بديلاً أكثر كفاءة ومبدئياً من الناحية الرياضية لعمليات أخذ العينات القائمة على البحث المكلفة.

Shreshth Saini, Avinab Saha, Balu Adsumilli, Neil Birkbeck, Yilin Wang, Alan C. Bovik2026-02-12
💬 NLP

EventCast: Hybrid Demand Forecasting in E-Commerce with LLM-Based Event Knowledge

يُعد EventCast إطار عمل تنبؤي نموذجي يعمل على تحسين التنبؤ بالطلب في التجارة الإلكترونية خلال فترات التأثير العالي عبر استخدام النماذج اللغوية الكبيرة لتحويل البيانات التجارية غير المهيكلة إلى ملخصات أحداث قابلة للتفسير، والتي يتم دمجها بعد ذلك مع بيانات السلاسل الزمنية التاريخية عبر بنية ذات برجين.

Congcong Hu, Yuang Shi, Fan Huang, Yang Xiang, Zhou Ye, Ming Jin, Shiyu Wang2026-02-12
🧬 biology

AntigenLM: Structure-Aware DNA Language Modeling for Influenza

يُعد AntigenLM نموذجاً لغوياً للحمض النووي (DNA) مدركاً للبنية، تم تدريبه مسبقاً على وحدات جينومية كاملة لفيروس الإنفلونزا، وهو يتفوق على الأساليب الحالية في التنبؤ بالمتغيرات المستضدية المستقبلية وتصنيف الأنواع الفرعية من خلال التقاط القيود التطورية الجوهرية.

Yue Pei, Xuebin Chi, Yu Kang2026-02-12
💬 NLP

Omni-Safety under Cross-Modality Conflict: Vulnerabilities, Dynamics Mechanisms and Efficient Alignment

تحدد هذه الورقة ثغرة "تحلل الطبقة الوسطى" (Mid-layer Dissolution) في النماذج اللغوية الكبيرة متعددة الوسائط (OLLMs) من خلال مجموعة بيانات جديدة وتحليل آلي، وتقترح **OmniSteer**، وهي طريقة محاذاة خفيفة الوزن تستخدم متجه رفض ذهبيًا للتخفيف بفعالية من مخاطر السلامة عبر الوسائط دون المساس بالقدرات العامة.

Kun Wang, Zherui Li, Zhenhong Zhou, Yitong Zhang, Yan Mi, Kun Yang, Yiming Zhang, Junhao Dong, Zhongxiang Sun, Qiankun L (…)2026-02-12
💬 NLP

Blockwise Advantage Estimation for Multi-Objective RL with Verifiable Rewards

تقترح الورقة البحثية **تقدير الميزة بالكتل (Blockwise Advantage Estimation)**، وهي طريقة للتعلم التعزيزي متعدد الأهداف تعمل على تخفيف تداخل الأهداف في التوليدات المهيكلة عن طريق تخصيص مزايا محددة لقطع نصية مقابلة باستخدام خط أساس فعال مشروط بالنتيجة يتجنب عمليات التدحرج المتداخلة المكلفة.

Kirill Pavlenko, Alexander Golubev, Simon Karasik, Boris Yangel2026-02-12