💻 computer science

Navigating Ideation Space: Decomposed Conceptual Representations for Positioning Scientific Ideas

تقدم هذه الورقة البحثية "فضاء التبلور" (Ideation Space)، وهو إطار تمثيل مفاهيمي مفكك يفصل المعرفة العلمية إلى مشكلات بحثية، ومنهجيات، ونتائج جوهرية لتمكين استرجاع أدق للأدبيات وتقييم أكثر تمييزاً للجدة، مما يعالج القيود الرئيسية في أساليب التضمين والتقييم القائمة على النماذج اللغوية الكبيرة الحالية.

Yuexi Shen, Minqian Liu, Dawei Zhou, Lifu Huang2026-01-15
💻 computer science

Can LLMs interpret figurative language as humans do?: surface-level vs representational similarity

بينما تتوافق النماذج اللغوية الكبيرة مع البشر في التفسير السطحي للحوار، إلا أنها تتباعد بشكل كبير عند المستوى التمثيلي، لا سيما عند معالجة اللغة المجازية المعتمدة على السياق والبراغماتية الاجتماعية مثل الاصطلاحات، واللغة العامية، والتهكم، حيث أظهر نموذج GPT-4 التقارب الأقرب للأنماط البشرية من بين النماذج التي تم اختبارها.

Samhita Bollepally, Aurora Sloman-Moll, Takashi Yamauchi2026-01-15
💻 computer science

Is Grokking Worthwhile? Functional Analysis and Transferability of Generalization Circuits in Transformers

تتحدى هذه الورقة البحثية المفهوم القائل بأن "الاستيعاب العميق" (grokking) يمثل تحولاً جوهرياً في قدرات الاستنتاج، حيث تثبت بدلاً من ذلك أن النماذج التي حققت هذا الاستيعاب تكتفي بمجرد دمج الحقائق المحفوظة في مسارات الاستدلال القائمة دون تحقيق قدرة فائقة على نقل التعلم أو إتقان حقيقي للمنطق التركيبي مقارنة بنظيراتها التي لم تحقق ذلك.

Kaiyu He, Zhang Mian, Peilin Wu, Xinya Du, Zhiyu Chen2026-01-15
💻 computer science

Efficient Multilingual Dialogue Processing via Translation Pipelines and Distilled Language Models

يحقق نظام فريق Kl33n3x لمهمة NLPAI4Health 2025 المشتركة تلخيصاً وتوليد إجابات على الأسئلة للحوارات متعددة اللغات عبر تسع لغات هندية من خلال استخدام خط معالجة ثلاثي المراحل يجمع بين الترجمة الأمامية، ونموذج لغوي مُقطّر بحجم 2.55 مليار معلمة، والترجمة العكسية، مما يثبت فعالية النماذج المدمجة غير المضبوطة بدقة لمعالجة اللغات ذات الموارد المنخفضة.

Santiago Martínez Novoa, Nicolás Rozo Fajardo, Diego Alejandro González Vargas, Nicolás Bedoya Figueroa2026-01-15
💻 computer science

Mi:dm 2.0 Korea-centric Bilingual Language Models

تقدم شركة KT نموذج Mi:dm 2.0، وهي عائلة نماذج لغوية كبيرة ثنائية اللغة تضم نسختين بـ 11.5 مليار و2.3 مليار معلمة، والتي تستفيد من خط معالجة بيانات شامل ومواءمة ثقافية لتحقيق أداء رائد في المعايير المرجعية الخاصة بكوريا مع دعم التطبيقات البحثية والتجارية تحت رخصة MIT.

Donghoon Shin, Sejung Lee, Soonmin Bae, Hwijung Ryu, Changwon Ok, Hoyoun Jung, Hyesung Ji, Jeehyun Lim, Jehoon Lee, Ji-E (…)2026-01-15
💻 computer science

From Symbolic to Natural-Language Relations: Rethinking Knowledge Graph Construction in the Era of Large Language Models

تجادل هذه الورقة البحثية بأن صعود النماذج اللغوية الكبيرة يستلزم تحولاً جذرياً في بناء الرسوم البيانية للمعرفة من مخططات العلاقات الرمزية الجامدة والمحددة مسبقاً إلى أوصاف علاقات قائمة على اللغة الطبيعية مرنة وغنية بالسياق، مدعومة بمبادئ تصميم هجينة توازن بين السلامة الهيكلية والدقة الدلالية.

Kanyao Han, Yushang Lai2026-01-15
💻 computer science

Distribution-Aligned Sequence Distillation for Superior Long-CoT Reasoning

تقدم هذه الورقة البحثية نموذج DASD-4B-Thinking، وهو نموذج استدلال خفيف الوزن ومفتوح المصدر يحقق أداءً هو الأفضل في فئته من خلال معالجة القيود الحرجة في عمليات التقطير الحالية على مستوى التسلسل عبر مسار تدريب مبتكر يعمل على مواءمة توزيعات المعلم والطالب بشكل أفضل ويخفف من انحياز التعرض، كل ذلك مع استخدام عينات تدريب أقل بكثير.

Shaotian Yan, Kaiyuan Liu, Chen Shen, Bing Wang, Sinan Fan, Jun Zhang, Yue Wu, Zheng Wang, Jieping Ye2026-01-15
💻 computer science

Adaptive Multi-Stage Patent Claim Generation with Unified Quality Assessment

تقدم هذه الورقة إطار عمل مبتكرًا ثلاثي المراحل لتوليد مطالبات براءات الاختراع متعددة المراحل والتكيفية، والذي يستفيد من تحليل التشابه المدرك للعلاقات، والتعلم المنهجي المتكيف مع المجال مع اختيار ديناميكي لتقنية (LoRA)، والتقييم الموحد للجودة، للتفوق بشكل كبير على النماذج الحالية في التعميم عبر الولايات القضائية، والنمذجة الدلالية، والاتساق مع تقييم الخبراء البشريين.

Chen-Wei Liang, Bin Guo, Zhen-Yuan Wei, Mu-Jiang-Shan Wang2026-01-15
💻 computer science

Relation Extraction Capabilities of LLMs on Clinical Text: A Bilingual Evaluation for English and Turkish

تقدم هذه الدراسة أول مجموعة بيانات ثنائية اللغة (الإنجليزية-التركية) لاستخراج العلاقات السريرية، وتُثبت أن النماذج اللغوية الكبيرة القائمة على التلقين، لا سيما عند تعزيزها باستراتيجية "الاسترجاع المدرك للعلاقة" المبتكرة، تتفوق على النماذج المرجعية التقليدية المضبوطة بدقة، مع الكشف عن فجوة في الأداء بين التقييمات باللغتين الإنجليزية والتركية.

Aidana Aidynkyzy, Oğuz Dikenelli, Oylum Alatlı, Şebnem Bora2026-01-15
💻 computer science

Improving Symbolic Translation of Language Models for Logical Reasoning

تقترح هذه الورقة إطار عمل لتعزيز قدرات الاستدلال المنطقي للنماذج اللغوية الأصغر حجماً من خلال تصنيف أخطاء الترجمة، وضبط النماذج باستخدام بيانات مُخلّقة، وتقديم نهج استدلال تدريجي مع التحقق من المحمول لتحسين دقة وموثوقية ترجمة اللغة الطبيعية إلى المنطق من الدرجة الأولى.

Ramya Keerthy Thatikonda, Jiuzhou Han, Wray Buntine, Ehsan Shareghi2026-01-15