🧬 biology

MolLangBench: A Comprehensive Benchmark for Language-Prompted Molecular Structure Recognition, Editing, and Generation

تقدم هذه الورقة MolLangBench، وهو معيار شامل لتقييم التعرف على البنية الجزيئية وتحريرها وتوليدها عبر الأوامر اللغوية، والذي يكشف أن حتى النماذج المتطورة مثل GPT-5 تعاني بشكل كبير في هذه المهام الكيميائية الأساسية رغم بساطتها البديهية بالنسبة للبشر.

Feiyang Cai, Jiahui Bai, Tao Tang, Guijuan He, Joshua Luo, Tianyu Zhu, Srikanth Pilla, Gang Li, Ling Liu, Feng Luo2026-03-24
💬 NLP

Comparative Analysis of AI Agent Architectures for Entity Relationship Classification

تقدم هذه الورقة تحليلاً مقارناً لثلاث بنيات لوكلاء الذكاء الاصطناعي لتصنيف علاقات الكيانات، مبرهنةً أن نهجاً جديداً لتوليد الأمثلة الديناميكية متعدد الوكلاء باستخدام التلقين التعاوني والتنافسي يتفوق باستمرار على التلقين القياسي القائم على أمثلة قليلة وينافس النماذج المضبوطة بدقة عبر مجالات متعددة.

Maryam Berijanian, Kuldeep Singh, Amin Sehati2026-03-24
💬 NLP

Theory-Grounded Evaluation of Human-Like Fallacy Patterns in LLM Reasoning

تقيم هذه الورقة ٣٨ نموذجاً لغوياً باستخدام نظرية الاستدلال الإيروتيتيكية (Erotetic Theory) لتوضيح أنه مع زيادة قدرة النماذج، تصبح أخطاؤها أكثر توافقاً مع أنماط مغالطات محددة تشبه الأنماط البشرية بدلاً من كونها أخطاء عشوائية، وأن ترتيب المقدمات يؤثر بشكل كبير على إنتاج المغالطات.

Andrew Keenan Richardson, Ryan Othniel Kearns, Sean Moss, Vincent Wang-Mascianica, Philipp Koralus2026-03-24
💬 NLP

Knowledge Fusion via Bidirectional Information Aggregation

تقدم هذه الورقة البحثية إطار عمل KGA، وهو إطار عمل جديد للاستدلال يدمج ديناميكيًا الرسوم البيانية للمعرفة الخارجية في النماذج اللغوية الكبيرة دون تعديل المعلمات، وذلك من خلال توظيف مسارات تآزرية لدمج المعرفة من الأسفل إلى الأعلى وتوجيه الانتباه من الأعلى إلى الأسفل للتغلب على قيود النماذج الثابتة والنسيان الكارثي.

Songlin Zhai, Guilin Qi, Yue Wang, Yuan Meng2026-03-24
💬 NLP

DMFI: A Dual-Modality Log Analysis Framework for Insider Threat Detection with LoRA-Tuned Language Models

تقترح الورقة البحثية إطار عمل DMFI، وهو إطار ثنائي الأنماط يعزز الكشف عن التهديدات الداخلية من خلال دمج تحليلات السجلات الدلالية والسلوكية عبر نماذج لغوية مضبوطة بشكل مستقل باستخدام تقنية LoRA واستراتيجية تكييف تمييزية، محققاً دقة فائقة على مجموعات بيانات CERT مقارنة بالأساليب المتطورة الحالية.

Kaichuan Kong, Dongjie Liu, Xiaobo Jin, Guanggang Geng, Zhiying Li, Jian Weng2026-03-24
💬 NLP

SafeConstellations: Mitigating Over-Refusals in LLMs Through Task-Aware Representation Steering

تقدم الورقة البحثية SafeConstellations، وهي طريقة تُستخدم أثناء عملية الاستدلال لتخفيف حدة حالات الرفض المفرط في النماذج اللغوية الكبيرة عبر تحديد وتوجيه مسارات التضمين الخاصة بالمهمة بعيداً عن أنماط الرفض، مما يقلل معدلات الرفض بنسبة تصل إلى 73% مع الحفاظ على الفائدة.

Utsav Maskey, Sumit Yadav, Mark Dras, Usman Naseem2026-03-24
💬 NLP

AmbiSQL: Interactive Ambiguity Detection and Resolution for Text-to-SQL

يُعد AmbiSQL نظاماً تفاعلياً يعزز دقة تحويل النص إلى لغة SQL من خلال الكشف التلقائي عن غموض الاستعلامات عبر تصنيف دقيق وتوجيه المستخدمين لتوضيح مقصدهم عبر أسئلة متعددة الخيارات، مما يؤدي إلى تحسين جودة توليد لغة SQL عند دمجه مع خلفية XiYan-SQL.

Zhongjun Ding, Yin Lin, Tianjing Zeng, Rong Zhu, Bolin Ding, Jingren Zhou2026-03-24
💬 NLP

GAICo: A Deployed and Extensible Framework for Evaluating Diverse and Multimodal Generative AI Outputs

إنّ GAICo هو إطار عمل مفتوح المصدر بلغة بايثون، مُنشر ومُفعّل، يعمل على توحيد وتسهيل عملية تقييم مخرجات الذكاء الاصطناً التوليدي المتنوعة ومتعددة الوسائط من خلال مجموعة موحدة وقابلة للتوسيع من المقاييس، وأدوات التصور، وإمكانيات إعداد التقارير لتعزيز قابلية التكرار وموثوقية النظام.

Nitin Gupta, Pallav Koppisetti, Kausik Lakkaraju, Biplav Srivastava2026-03-24
💬 NLP

Hybrid Architectures for Language Models: Systematic Analysis and Design Insights

تقدم هذه الورقة تقييماً شاملاً لبنيات النماذج اللغوية الهجينة التي تجمع بين آلية الانتباه الذاتي ونماذج فضاء الحالة المهيكلة، حيث تقارن بشكل منهجي بين استراتيجيات الدمج البيني والدمج داخل الطبقات عبر أبعاد الأداء والكفاءة والتوسع لاستخلاص وصفات التصميم المثلى للتطوير المستقبلي.

Sangmin Bae, Bilge Acun, Chien-Yu Lin, Haroun Habeeb, Seungyeon Kim, Liang Luo, Junjie Wang, Carole-Jean Wu2026-03-24
💬 NLP

Flipping the Dialogue: Training and Evaluating User Language Models

تقدم هذه الورقة نماذج لغوية مخصصة للمستخدمين (User LMs) صُممت خصيصاً لمحاكاة السلوك البشري في المحادثات متعددة الأدوار بدقة أكبر، كاشفةً أن المحاكيات الحالية القائمة على النماذج المساعدة معيبة، وأن المحاكاة الواقعية للمستخدم تكشف بشكل كبير عن أوجه القصور حتى في النماذج المساعدة رفيعة المستوى.

Tarek Naous, Philippe Laban, Wei Xu, Jennifer Neville2026-03-24