🧬 biology

PREFER: An Ontology for the PREcision FERmentation Community

تقدم الورقة البحثية PREFER، وهو أنطولوجيا مفتوحة المصدر متوافقة مع الأنطولوجيا الأساسية (BFO)، والتي تضع معياراً موحداً لبيانات التخمير الدقيق للتغلب على تحديات التشغيل البيني، وتمكين التنفيذ الآلي عبر المنصات، وتسهيل التعلم الآلي في البيولوجيا التركيبية.

Txell Amigó, Shawn Zheng Kai Tan, Angel Luu Phanthanourak, Sebastian Schulz, Pasquale D. Colaianni, Dominik M. Maszczyk (…)2026-02-20
💬 NLP

References Improve LLM Alignment in Non-Verifiable Domains

تقترح هذه الورقة نهجاً موجهاً بالمرجع يستفيد من مخرجات مرجعية عالية الجودة لتعزيز المقيمين القائمين على النماذج اللغوية الكبيرة، مما يتيح التحسين الذاتي والضبط المحاذي الفعال في المجالات غير القابلة للتحقق حيث لا تتوفر مكافآت تقليدية قابلة للتحقق.

Kejian Shi, Yixin Liu, Peifeng Wang, Alexander R. Fabbri, Shafiq Joty, Arman Cohan2026-02-20
💬 NLP

Evaluating Monolingual and Multilingual Large Language Models for Greek Question Answering: The DemosQA Benchmark

تقدم هذه الورقة البحثية معيار DemosQA، وهو مجموعة بيانات جديدة للأسئلة والأجوبة باللغة اليونانية مستمدة من وسائل التواصل الاجتماعي، وتقدم تقييماً شاملاً لـ 11 نموذجاً من النماذج اللغوية الكبيرة أحادية اللغة ومتعددة اللغات لتقييم فعاليتها في استيعاب الفروق الدقيقة الاجتماعية والثقافية اليونانية.

Charalampos Mastrokostas, Nikolaos Giarelis, Nikos Karacapilidis2026-02-20
💬 NLP

Hybrid-Gym: Training Coding Agents to Generalize Across Tasks

تقدم هذه الورقة Hybrid-Gym، وهي بيئة تدريب تتكون من مهام اصطناعية قابلة للتوسع مصممة لتعليم النماذج اللغوية مهارات برمجة قابلة للنقل، مما يحسن بشكل كبير أداء تعميمها على معايير متنوعة من العالم الحقيقي مثل SWE-Bench وSWT-Bench.

Yiqing Xie, Emmy Liu, Gaokai Zhang, Nachiket Kotalwar, Shubham Gandhi, Sathwik Acharya, Xingyao Wang, Carolyn Rose, Grah (…)2026-02-20
💬 NLP

IndicJR: A Judge-Free Benchmark of Jailbreak Robustness in South Asian Languages

تقدم هذه الورقة IndicJR، وهو معيار خالي من استخدام القضاة (judge-free) لتقييم متانة كسر الحماية (jailbreak robustness) عبر 12 لغة من جنوب آسيا، كاشفةً أن عمليات محاذاة السلامة الحالية متضخمة بسبب التنسيقات المقيدة تعاقدياً، وعرضة بشدة لهجمات النقل من الإنجليزية إلى اللغات الهندية، ومتضررة بشكل كبير بفعل المدخلات المكتوبة بالأحرف اللاتينية (romanized) أو النصوص المختلطة.

Priyaranjan Pattnayak, Sanchari Chowdhuri2026-02-20
💬 NLP

Claim Automation using Large Language Model

تثبت هذه الورقة أن نموذج لغة كبير تم ضبطه بدقة باستخدام التكيف منخفض الرتبة (LoRA) ومنشور محلياً، يتفوق بشكل كبير على النماذج العامة في توليد توصيات دقيقة وهيكلية للإجراءات التصحيحية لمطالبات التأمين، مما يقدم حلاً موثوقاً وقابلاً للحوكمة لأتمتة اتخاذ القرار في المجالات المنظمة.

Zhengda Mo, Zhiyu Quan, Eli O'Donohue, Kaiwen Zhong2026-02-20
💬 NLP

Training Large Reasoning Models Efficiently via Progressive Thought Encoding

تقدم هذه الورقة البحثية "الترميز الفكري التصاعدي" (Progressive Thought Encoding)، وهي طريقة لضبط النماذج بدقة وكفاءة في المعلمات، تُمكّن نماذج الاستدلال الضخمة من تحقيق دقة أعلى بكثير في اختبارات الرياضيات المعقدة مع التغلب على اختناقات الذاكرة عبر ترميز الاستدلال الوسيط في ناقلات ثابتة الحجم، مما يلغي الحاجة إلى الانتشار العكسي لكامل الذاكرة المؤقتة أثناء التعلم التعزيزي.

Zeliang Zhang, Xiaodong Liu, Hao Cheng, Hao Sun, Chenliang Xu, Jianfeng Gao2026-02-20
💬 NLP

ConvApparel: A Benchmark Dataset and Validation Framework for User Simulators in Conversational Recommenders

تقدم هذه الورقة ConvApparel، وهي مجموعة بيانات جديدة وإطار عمل تقييمي شامل مصمم لسد "فجوة الواقعية" في محاكيات المستخدم القائمة على النماذج اللغوية الكبيرة لأنظمة التوصية الحوارية، وذلك عبر الاستفادة من بروتوكول جمع بيانات ثنائي الوكلاء والتحقق من صحة التناقض الواقعي لإثبات أن المحاكيات القائمة على البيانات توفر تعميماً أكثر قوة من النماذج المرجعية القائمة على التلقين.

Ofer Meshi, Krisztian Balog, Sally Goldman, Avi Caciularu, Guy Tennenholtz, Jihwan Jeong, Amir Globerson, Craig Boutilie (…)2026-02-20
💬 NLP

When Semantic Overlap Is Not Enough: Cross-Lingual Euphemism Transfer Between Turkish and English

تتقصى هذه الدراسة انتقال التلطيف اللغوي عبر اللغات بين التركية والإنجليزية، كاشفةً أن التداخل الدلالي وحده غير كافٍ لضمان الانتقال الإيجابي، وأن الأداء يمكن أن يتحسن أحياناً باستخدام مصطلحات غير متداخلة بسبب الاختلافات في توزيع الملصقات والسياق البراغماتي.

Hasan Can Biyik, Libby Barak, Jing Peng, Anna Feldman2026-02-20
💬 NLP

Eigenmood Space: Uncertainty-Aware Spectral Graph Analysis of Psychological Patterns in Classical Persian Poetry

تقدم هذه الورقة "فضاء إيغنمود" (Eigenmood Space)، وهو إطار حوسبي مدرك لعدم اليقين يحلل الأنماط النفسية في الشعر الفارسي الكلاسيكي عبر تجميع التوصيفات متعددة الملصقات الموزونة بالثقة في تضمينات رسوم بيانية طيفية، مما يتيح استدلالاً على مستوى الشاعر يتسم بالقابلية للتوسع والتدقيق والحذر التفسيري مع نشر عدم يقين الأدلة بشكل صريح.

Kourosh Shahnazari, Seyed Moein Ayyoubzadeh, Mohammadali Keshtparvar2026-02-20