🧬 biology

PhageBench: Can LLMs Understand Raw Bacteriophage Genomes?

تقدم هذه الورقة البحثية PhageBench، وهو أول معيار لتقييم النماذج اللغوية الكبيرة على جينومات العاثيات (البكتيريوفاج) الخام من خلال سير عمل مكون من خمس مهام، والذي كشف أنه في حين تُظهر النماذج العامة قدرة واعدة في تحديد الهوية الأساسي والتنبؤ بالمضيف، إلا أنها تعاني حالياً في التعامل مع الاستدلال المعقد الذي يتضمن التبعيات طويلة المدى والتوطين الوظيفي دقيق التفاصيل.

Yusen Hou, Weicai Long, Haitao Hu, Houcheng Su, Junning Feng, Yanlin Zhang2026-04-08
💬 NLP

What Models Know, How Well They Know It: Knowledge-Weighted Fine-Tuning for Learning When to Say "I Don't Know"

تقترح هذه الورقة طريقة ضبط دقيق موزونة معرفياً تستخدم درجات المعرفة على مستوى المثيل لمساعدة النماذج اللغوية الكبيرة على التعبير صراحة عن عدم اليقين تجاه الاستعلامات خارج النطاق مع الحفاظ على الدقة في المواضيع المعروفة، مما يقلل من الهلوسة الناتجة عن عدم توافق المعرفة.

Joosung Lee, Hwiyeol Jo, Donghyeon Ko, Kyubyung Chae, Cheonbok Park, Jeonghoon Kim2026-04-08
💬 NLP

CLEAR: Cross-Lingual Enhancement in Alignment via Reverse-training

تقترح الورقة البحثية CLEAR، وهي دالة فقدان تدريب عكسي مبتكرة تستفيد من اللغة الإنجليزية كجسر لتعزيز المحاذاة عبر اللغات وأداء الاسترجاع، لا سيما بالنسبة للغات ذات الموارد المنخفضة، مع تقليل التدهور في اللغة الإنجليزية إلى أدنى حد.

Seungyoon Lee, Minhyuk Kim, Seongtae Hong, Youngjoon Jang, Dongsuk Oh, Heuiseok Lim2026-04-08
💬 NLP

"OK Aura, Be Fair With Me": Demographics-Agnostic Training for Bias Mitigation in Wake-up Word Detection

تُظهر هذه الدراسة أن تقنيات التدريب غير المعتمدة على الخصائص الديموغرافية، وتحديداً تعزيز البيانات وتقطير المعرفة، تقلل بشكل كبير من التفاوت في الأداء في اكتشاف كلمة التنبيه عبر مجموعات المتحدثين المتنوعة من خلال استبعاد التصنيفات الديموغرافية خلال مرحلة التدريب.

Fernando López, Paula Delgado-Santos, Pablo Gómez, David Solans, Jordi Luque2026-04-08
💬 NLP

AgentGL: Towards Agentic Graph Learning with LLMs via Reinforcement Learning

يقدم AgentGL إطار عمل جديد للتعلم التعزيزي يمكّن النماذج اللغوية الكبيرة من التنقل والاستدلال ذاتياً في البيئات العلاقاتية المعقدة عبر دمج الاستكشاف الرسومي المدرك للطوبولوجيا مع التفكير المقيد بالبحث، محققاً مكاسب كبيرة في مهام تصنيف العقد وتنبؤ الروابط.

Yuanfu Sun, Kang Li, Dongzhe Fan, Jiajin Liu, Qiaoyu Tan2026-04-08
💬 NLP

Evaluating Learner Representations for Differentiation Prior to Instructional Outcomes

تقدم هذه الورقة "التميز" (distinctiveness)، وهو مقياس على مستوى التمثيل يقيم تمثيلات المتعلمين بناءً على قدرتها على الحفاظ على الفروق الجوهرية بين الطلاب دون الحاجة إلى مخرجات تعليمية، مما يثبت أن التمثيلات المجمعة على مستوى المتعلم تتفوق على التمثيلات على مستوى التفاعل في دعم النمذجة المتمايزة والتخصيص.

Junsoo Park, Youssef Medhat, Htet Phyo Wai, Ploy Thajchayapong, Ashok K. Goel2026-04-08
💬 NLP

Understanding Performance Gap Between Parallel and Sequential Sampling in Large Reasoning Models

تتقصى هذه الورقة البحثية سبب تفوق أخذ العينات المتوازي على أخذ العينات المتسلسل في نماذج الاستدلال الكبيرة رغم المزايا النظرية للأخير، وتخلص من خلال التحليل التجريبي إلى أن فجوة الأداء ناتجة أساساً عن انخفاض الاستكشاف في أخذ العينات المتسلسل بسبب الاشتراط على الإجابات السابقة، وليس بسبب قيود التجميع أو قيود طول السياق.

Xiangming Gu, Soham De, Larisa Markeeva, Petar Veličković, Razvan Pascanu2026-04-08
💬 NLP

Mechanistic Circuit-Based Knowledge Editing in Large Language Models

تقدم هذه الورقة إطار عمل MCircKE، وهو إطار عمل مبتكر يسد "فجوة الاستنتاج" في تحرير المعرفة من خلال تحديد وتحديث الدوائر السببية المسؤولة عن مهام استنتاجية محددة جراحياً، مما يمكّن النماذج اللغوية الكبيرة من استخدام الحقائق المحررة بفعالية في سلاسل الاستنتاج متعددة الخطوات.

Tianyi Zhao, Yinhan He, Wendy Zheng, Chen Chen2026-04-08
💬 NLP

FRENCH-YMCA: A FRENCH Corpus meeting the language needs of Youth, froM Children to Adolescents

تقدم هذه الورقة البحثية مجموعة بيانات "French-YMCA"، وهي مورد لغوي واسع النطاق ومفتوح الوصول يضم أكثر من 22 مليون كلمة من مصادر متنوعة، صُممت خصيصاً لتدريب النماذج اللغوية التي تفهم وتتكيف بشكل أفضل مع الاحتياجات اللغوية المتطورة للأطفال والمراهقين الناطقين بالفرنسية.

Cherifa Ben Khelil, Jean-Yves Antoine, Anaïs Halftermeyer, Frédéric Rayar, Mathieu Thebaud2026-04-08
💬 NLP

FrontierFinance: A Long-Horizon Computer-Use Benchmark of Real-World Financial Tasks

تقدم الورقة البحثية FrontierFinance، وهو معيار طويل المدى يتكون من 25 مهمة نمذجة مالية معقدة تم تطويرها مع خبراء في الصناعة لتقييم ومقارنة أداء النماذج اللغوية الكبيرة الحديثة مقابل المتخصصين البشريين، مما يكشف أن الأنظمة الحالية للذكاء الاصطناعي لا تزال قاصرة عن تقديم مخرجات جاهزة للعملاء.

Michael Krumdick, Varshini Reddy, Shivani Chaudhary, William Day, Maarij Ahmed, Hayan Haqqi, Muhammad Ahsen Fahim, Hanza (…)2026-04-08