💻 computer science

PediaMind-R1: A Temperament-Aware Language Model for Personalized Early Childhood Care Reasoning via Cognitive Modeling and Preference Alignment

تقدم هذه الورقة البحثية PediaMind-R1، وهو نموذج لغوي كبير متخصص يدمج نظرية "توماس-تشيس" للمزاج ومسار تدريب ثنائي المراحل لتقديم استدلال مخصص وقائم على أسس نفسية لرعاية الطفولة المبكرة.

Zihe Zhang, Can Zhang, Yanheng Xu, Xin Hu, Jichao Leng2026-01-15
💻 computer science

Gaming the Answer Matcher: Examining the Impact of Text Manipulation on Automated Judgment

تُظهر هذه الدراسة أن المطابقة الآلية للإجابات باستخدام النماذج اللغوية الكبيرة تظل قوية في مواجهة تكتيكات التلاعب النصي الاستراتيجي مثل الإطناب وتضمين الإجابة، حيث أثبت التقييم الثنائي فعالية خاصة، مما يؤكد موثوقيتها كبديل قابل للتوسع للتقييم البشري عند توفر إجابات مرجعية.

Manas Khatore, Sumana Sridharan, Kevork Sulahian, Benjamin J. Smith, Shi Feng2026-01-15
💻 computer science

Navigating Ideation Space: Decomposed Conceptual Representations for Positioning Scientific Ideas

تقدم هذه الورقة البحثية "فضاء التبلور" (Ideation Space)، وهو إطار تمثيل مفاهيمي مفكك يفصل المعرفة العلمية إلى مشكلات بحثية، ومنهجيات، ونتائج جوهرية لتمكين استرجاع أدق للأدبيات وتقييم أكثر تمييزاً للجدة، مما يعالج القيود الرئيسية في أساليب التضمين والتقييم القائمة على النماذج اللغوية الكبيرة الحالية.

Yuexi Shen, Minqian Liu, Dawei Zhou, Lifu Huang2026-01-15
💻 computer science

Can LLMs interpret figurative language as humans do?: surface-level vs representational similarity

بينما تتوافق النماذج اللغوية الكبيرة مع البشر في التفسير السطحي للحوار، إلا أنها تتباعد بشكل كبير عند المستوى التمثيلي، لا سيما عند معالجة اللغة المجازية المعتمدة على السياق والبراغماتية الاجتماعية مثل الاصطلاحات، واللغة العامية، والتهكم، حيث أظهر نموذج GPT-4 التقارب الأقرب للأنماط البشرية من بين النماذج التي تم اختبارها.

Samhita Bollepally, Aurora Sloman-Moll, Takashi Yamauchi2026-01-15
💻 computer science

Is Grokking Worthwhile? Functional Analysis and Transferability of Generalization Circuits in Transformers

تتحدى هذه الورقة البحثية المفهوم القائل بأن "الاستيعاب العميق" (grokking) يمثل تحولاً جوهرياً في قدرات الاستنتاج، حيث تثبت بدلاً من ذلك أن النماذج التي حققت هذا الاستيعاب تكتفي بمجرد دمج الحقائق المحفوظة في مسارات الاستدلال القائمة دون تحقيق قدرة فائقة على نقل التعلم أو إتقان حقيقي للمنطق التركيبي مقارنة بنظيراتها التي لم تحقق ذلك.

Kaiyu He, Zhang Mian, Peilin Wu, Xinya Du, Zhiyu Chen2026-01-15
💻 computer science

Efficient Multilingual Dialogue Processing via Translation Pipelines and Distilled Language Models

يحقق نظام فريق Kl33n3x لمهمة NLPAI4Health 2025 المشتركة تلخيصاً وتوليد إجابات على الأسئلة للحوارات متعددة اللغات عبر تسع لغات هندية من خلال استخدام خط معالجة ثلاثي المراحل يجمع بين الترجمة الأمامية، ونموذج لغوي مُقطّر بحجم 2.55 مليار معلمة، والترجمة العكسية، مما يثبت فعالية النماذج المدمجة غير المضبوطة بدقة لمعالجة اللغات ذات الموارد المنخفضة.

Santiago Martínez Novoa, Nicolás Rozo Fajardo, Diego Alejandro González Vargas, Nicolás Bedoya Figueroa2026-01-15
💻 computer science

Mi:dm 2.0 Korea-centric Bilingual Language Models

تقدم شركة KT نموذج Mi:dm 2.0، وهي عائلة نماذج لغوية كبيرة ثنائية اللغة تضم نسختين بـ 11.5 مليار و2.3 مليار معلمة، والتي تستفيد من خط معالجة بيانات شامل ومواءمة ثقافية لتحقيق أداء رائد في المعايير المرجعية الخاصة بكوريا مع دعم التطبيقات البحثية والتجارية تحت رخصة MIT.

Donghoon Shin, Sejung Lee, Soonmin Bae, Hwijung Ryu, Changwon Ok, Hoyoun Jung, Hyesung Ji, Jeehyun Lim, Jehoon Lee, Ji-E (…)2026-01-15
💻 computer science

From Symbolic to Natural-Language Relations: Rethinking Knowledge Graph Construction in the Era of Large Language Models

تجادل هذه الورقة البحثية بأن صعود النماذج اللغوية الكبيرة يستلزم تحولاً جذرياً في بناء الرسوم البيانية للمعرفة من مخططات العلاقات الرمزية الجامدة والمحددة مسبقاً إلى أوصاف علاقات قائمة على اللغة الطبيعية مرنة وغنية بالسياق، مدعومة بمبادئ تصميم هجينة توازن بين السلامة الهيكلية والدقة الدلالية.

Kanyao Han, Yushang Lai2026-01-15
💻 computer science

Distribution-Aligned Sequence Distillation for Superior Long-CoT Reasoning

تقدم هذه الورقة البحثية نموذج DASD-4B-Thinking، وهو نموذج استدلال خفيف الوزن ومفتوح المصدر يحقق أداءً هو الأفضل في فئته من خلال معالجة القيود الحرجة في عمليات التقطير الحالية على مستوى التسلسل عبر مسار تدريب مبتكر يعمل على مواءمة توزيعات المعلم والطالب بشكل أفضل ويخفف من انحياز التعرض، كل ذلك مع استخدام عينات تدريب أقل بكثير.

Shaotian Yan, Kaiyuan Liu, Chen Shen, Bing Wang, Sinan Fan, Jun Zhang, Yue Wu, Zheng Wang, Jieping Ye2026-01-15
💻 computer science

Adaptive Multi-Stage Patent Claim Generation with Unified Quality Assessment

تقدم هذه الورقة إطار عمل مبتكرًا ثلاثي المراحل لتوليد مطالبات براءات الاختراع متعددة المراحل والتكيفية، والذي يستفيد من تحليل التشابه المدرك للعلاقات، والتعلم المنهجي المتكيف مع المجال مع اختيار ديناميكي لتقنية (LoRA)، والتقييم الموحد للجودة، للتفوق بشكل كبير على النماذج الحالية في التعميم عبر الولايات القضائية، والنمذجة الدلالية، والاتساق مع تقييم الخبراء البشريين.

Chen-Wei Liang, Bin Guo, Zhen-Yuan Wei, Mu-Jiang-Shan Wang2026-01-15