💬 NLP

Evaluating LLMs' Divergent Thinking Capabilities for Scientific Idea Generation with Minimal Context

تقدم هذه الورقة LiveIdeaBench، وهو معيار مرجعي جديد يقيم قدرات التفكير التباعدي للنماذج اللغوية الكبيرة في توليد الأفكار العلمية باستخدام حد أدنى من السياق، مما يكشف أن الأداء الإبداعي لا يمكن التنبؤ به بشكل جيد عبر مقاييس الذكاء العام، ويقترح الحاجة إلى استراتيجيات تدريب متخصصة لتعزيز الإبداع العلمي.

Kai Ruan, Xuan Wang, Jixiang Hong, Peng Wang, Yang Liu, Hao Sun2026-02-24
💬 NLP

Dialogue is Better Than Monologue: Instructing Medical LLMs via Strategical Conversations

تقدم هذه الورقة معياراً محاذياً لاختبار الترخيص الطبي للولايات المتحدة (USMLE) يحاكي سيناريوهات تشخيصية مشوبة بالضجيج، وتُظهر أن الضبط الدقيق القائم على الحوار يتفوق بشكل كبير على طرق التدريب الاستاتيكية التقليدية في تعزيز دقة الاستدلال ومتانة النماذج اللغوية الكبيرة الطبية.

Zijie Liu, Xinyu Zhao, Jie Peng, Zhuangdi Zhu, Qingyu Chen, Kaidi Xu, Xia Hu, Tianlong Chen2026-02-24
💬 NLP

Beyond Single-Turn: A Survey on Multi-Turn Interactions with Large Language Models

تستعرض هذه الدراسة المسحية بشكل شامل التحديات، والمعايير المرجعية، ومنهجيات التحسين للتفاعلات متعددة الأدوار مع النماذج اللغوية الكبيرة، حيث تصنف التطورات عبر المجالات الموجهة نحو المهام والإعدادات الحوارية مع تحديد الاتجاهات البحثية المستقبلية لتعزيز المتانة والفعالية.

Yubo Li, Xiaobin Shen, Xinyu Yao, Xueying Ding, Yidi Miao, Ramayya Krishnan, Rema Padman2026-02-24
💬 NLP

CodePDE: An Inference Framework for LLM-driven PDE Solver Generation

تقدم هذه الورقة البحثية CodePDE، وهو أول إطار استدلال يسخر النماذج اللغوية الكبيرة لتوليد برمجيات حل المعادلات التفاضلية الجزئية كأكواد برمجية، مما يثبت أن استراتيجيات الاستدلال المتقدمة وتوسيع نطاق وقت الاختبار تمكن النماذج اللغوية الكبيرة من حل المعادلات التفاضلية الجزئية المعقدة بفعالية مع توفير رؤى نقدية حول عمليات الاستنتاج، وتصحيح الأخطاء، ومقايضات الموثوقية.

Shanda Li, Tanya Marwah, Junhong Shen, Weiwei Sun, Andrej Risteski, Yiming Yang, Ameet Talwalkar2026-02-24
💬 NLP

From Weak Labels to Strong Results: Utilizing 5,000 Hours of Noisy Classroom Transcripts with Minimal Accurate Data

تقترح هذه الورقة البحثية "التعلم المسبق ضعيف الإشراف" (WSP)، وهي منهجية من خطوتين تستفيد من النصوص المفرغة الوفيرة والمليئة بالضجيج من الحصص الدراسية، يتبعها الضبط الدقيق على بيانات دقيقة محدودة لتحقيق أداء فائق في سيناريوهات التعرف التلقائي على الكلام ذات الموارد المنخفضة.

Ahmed Adel Attia, Dorottya Demszky, Jing Liu, Carol Espy-Wilson2026-02-24
💬 NLP

Counting trees: A treebank-driven exploration of syntactic variation in speech and writing across languages

تقدم هذه الورقة إطار عمل استقرائيًا جديدًا مدفوعًا بالبنك الشجري (treebank) باستخدام التبعيات العالمية (Universal Dependencies) لتوضيح أن اللغة المنطوقة عبر الإنجليزية والسلوفينية تعتمد على مجموعة من البنى النحوية أصغر، وأقل تنوعًا، وغير متداخلة إلى حد كبير مقارنة باللغة المكتوبة، مما يعكس المتطلبات الخاصة بكل نمط من حيث التفاعلية والاقتصاد.

Kaja Dobrovoljc2026-02-24
💬 NLP

Cross-lingual Collapse: How Language-Centric Foundation Models Shape Reasoning in Large Language Models

تحدد هذه الورقة وتحلل ظاهرة "الانهيار عبر اللغات" (Cross-lingual Collapse)، وهي ظاهرة يتسبب فيها التعلم المعزز بالمكافآت القابلة للتحقق (RLVR) في عودة النماذج اللغوية الكبيرة متعددة اللغات بسلاسل الاستدلال الخاصة بها إلى لغة تدريب مسبق مهيمنة (الإنجليزية عادةً) مع تحسن أداء الاستدلال، مما يكشف عن مقايضة مستمرة بين عمق الاستدلال ودقة اللغة المستهدفة.

Cheonbok Park, Jeonghoon Kim, Joosung Lee, Sanghwan Bae, Jaegul Choo, Kang Min Yoo2026-02-24
💬 NLP

Shop-R1: Rewarding LLMs to Simulate Human Behavior in Online Shopping via Reinforcement Learning

تقدم هذه الورقة Shop-R1، وهو إطار عمل جديد للتعلم التعزيزي يعزز قدرة النماذج اللغوية الكبيرة على محاكاة سلوك التسوق عبر الإنترنت البشري من خلال تفكيك المهمة إلى مرحلتي توليد المبررات وتوقع الإجراءات، حيث يتم توجيه كل منهما عبر إشارات مكافأة متميزة ذاتية الإشراف وهرمية لتحقيق تحسن يزيد عن 65% مقارنة بالنماذج المرجعية.

Yimeng Zhang, Tian Wang, Jiri Gesi, Ziyi Wang, Yuxuan Lu, Jiacheng Lin, Sinong Zhan, Vianne Gao, Ruochen Jiao, Junze Liu (…)2026-02-24
💬 NLP

Role-Aware Language Models for Secure and Contextualized Access Control in Organizations

تتقصى هذه الورقة البحثية عملية الضبط الدقيق للنماذج اللغوية الكبيرة لفرض التحكم في الوصول القائم على الأدوار في بيئات المؤسسات، وذلك من خلال تقييم ثلاث استراتيجيات للنمذجة على مجموعات بيانات مُنشأة حديثاً، وفحص مدى متانتها ضد التهديدات الأمنية مثل حقن الأوامر والكسر البرمجي.

Saeed Almheiri, Yerulan Kongrat, Adrian Santosh, Ruslan Tasmukhanov, Josemaria Loza Vera, Muhammad Dehan Al Kautsar, Faj (…)2026-02-24
💬 NLP

MolReasoner: Toward Effective and Interpretable Reasoning for Molecular LLMs

يُعد MolReasoner إطار عمل جديداً ثنائي المراحل يعزز قابلية التفسير والدقة في الاستنتاج الجزيئي في النماذج اللغوية الكبيرة من خلال الجمع بين الضبط الدقيق لسلسلة الأفكار المعززة بالمعرفة ومرحلة التعلم التعزيزي المتكيف مع المهام للحد بفعالية من الهلوسة والتفوق على النماذج المرجعية الحالية.

Guojiang Zhao, Zixiang Lu, Yutang Ge, Sihang Li, Zheng Cheng, Haitao Lin, Lirong Wu, Hanchen Xia, Hengxing Cai, Wentao G (…)2026-02-24