💬 NLP

Optimizing Soft Prompt Tuning via Structural Evolution

تقترح هذه الورقة البحثية فقدان الترويسة الناعمة الطوبولوجي (TSLoss)، وهي طريقة تحسين مبتكرة تستفيد من الهومولوجيا المستمرة لقياس وتوجيه التطور الهيكلي للترويسات الناعمة، مما يعزز قابليتها للتفسير، وسرعة تقاربها، وأدائها في المهام اللاحقة.

Zhenzhen Huang, Chaoning Zhang, Haoyu Bian, Songbo Zhang, Chi-lok Andy Tai, Jiaquan Zhang, Caiyan Qin, Jingjing Qu, Yala (…)2026-02-19
💬 NLP

CitiLink-Summ: Summarization of Discussion Subjects in European Portuguese Municipal Meeting Minutes

تقدم هذه الورقة CitiLink-Summ، وهي أول متن لغوي باللغة البرتغالية الأوروبية لمحاضر الاجتماعات البلدية يضم 2,322 ملخصاً تم إعدادها يدوياً، وذلك لمعالجة ندرة البيانات الخاصة بالتلخيص الآلي في هذا المجال وتحديد أداء خط الأساس للنماذج التوليدية الحديثة والنماذج اللغوية الكبيرة.

Miguel Marques, Ana Luísa Fernandes, Ana Filipa Pacheco, Rute Rebouças, Inês Cantante, José Isidro, Luís Filipe Cunha, A (…)2026-02-19
💬 NLP

Quecto-V1: Empirical Analysis of 8-bit Quantized Small Language Models for On-Device Legal Retrieval

تقدم هذه الورقة البحثية نموذج Quecto-V1، وهو نموذج لغوي صغير يضم 124 مليون معلمة، تم تدريبه حصرياً على القوانين الهندية وضغطه إلى أقل من 150 ميجابايت عبر تقنية التكميم بـ 8 بت، مما يثبت أن النشر المتخصص في مجال معين وبشكل غير متصل بالإنترنت يمكن أن يساهم بفعالية في دمقرطة الذكاء القانوني مع الحفاظ على سيادة البيانات ودقة الاسترجاع العالية.

Subrit Dikshit2026-02-19
⚡ electrical engineering

Scaling Open Discrete Audio Foundation Models with Interleaved Semantic, Acoustic, and Text Tokens

تقدم هذه الورقة البحثية SODA، وهي مجموعة من النماذج التأسيسية الصوتية الأصلية التي تدمج النمذجة المشتركة للرموز الدلالية والصوتية والنصية، وتضع وصفة تدريب معتمدة وقوانين توسع من خلال دراسة تجريبية واسعة النطاق لـ 64 نموذجاً لإثبات الأداء المتفوق عبر مهام صوتية ومتعددة الوسائط متنوعة.

Potsawee Manakul, Woody Haosheng Gan, Martijn Bartelds, Guangzhi Sun, William Held, Diyi Yang2026-02-19
💬 NLP

Reinforced Fast Weights with Next-Sequence Prediction

تقدم الورقة البحثية إطار عمل REFINE، وهو إطار تعلم تعزيزي يستخدم التنبؤ بالتسلسل التالي وتحسين السياسة النسبي للمجموعات للتغلب على قيود التنبؤ بالرمز التالي في بنيات الأوزان السريعة، مما يعزز بشكل كبير قدرات نمذجة السياق الطويل لديها عبر مهام متنوعة.

Hee Seung Hwang, Xindi Wu, Sanghyuk Chun, Olga Russakovsky2026-02-19
💬 NLP

Differentiating Between Human-Written and AI-Generated Texts Using Automatically Extracted Linguistic Features

تستخدم هذه الدراسة الاستكشافية التحليل اللغوي الآلي لتوضيح أنه على الرغم من قدرة ChatGPT على محاكاة الكتابة البشرية، إلا أن هناك فروقاً جوهرية قابلة للقياس في السمات الفونولوجية والمورفولوجية والنحوية والمعجمية بين النصوص المولدة بواسطة الذكاء الاصطناعي والنصوص التي ألفها البشر، مما يسلط الضوء على الحاجة إلى تحسين تدريب الذكاء الاصطناعي وأدوات التقييم الآلي.

Georgios P. Georgiou2026-02-18
💬 NLP

Intermittent Semi-Working Mask: A New Masking Paradigm for LLMs

تقدم هذه الورقة البحثية قناع العمل المتقطع شبه المستمر (ISM)، وهو مخطط قناع غير معتمد على المعلمات يحقن انتباهًا ثنائي الاتجاه متفرقًا في النماذج اللغوية الكبيرة السببية لتعزيز أداء الحوار متعدد الجولات والاستدلال كثيف السياق مع الحفاظ على كفاءة الاستدلال وتجنب التوسع المكلف في بيانات التدريب.

HaoYuan Hu, Mingcong Lu, Di Luo, XinYa Wu, Jiangcai Zhu, Taoye Yin, Zheng Li, Hao Wang, Shusheng Zhang, KeZun Zhang, Kai (…)2026-02-18
💬 NLP

Human-like Affective Cognition in Foundation Models

تقدم هذه الورقة إطار تقييم شاملًا يثبت أن النماذج التأسيسية الحديثة تُظهر إدراكًا عاطفيًا شبيهًا بالبشر، وفي بعض الحالات "فائقًا للبشر"، من خلال الاستنتاج الدقيق للعلاقات بين التقييمات، والعواطف، والتعبيرات، والنتائج، مع تعزيز الأداء بشكل أكبر عبر تسلسل التفكير المنطقي.

Kanishk Gandhi, Zoe Lynch, Jan-Philipp Fränken, Kayla Patterson, Sharon Wambu, Tobias Gerstenberg, Desmond C. Ong, Noah (…)2026-02-18
💬 NLP

Moving Beyond Medical Exams: A Clinician-Annotated Fairness Dataset of Real-World Tasks and Ambiguity in Mental Healthcare

تقدم هذه الورقة مجموعة بيانات تركز على الولايات المتحدة، وموسومة من قبل أطباء، لمهام رعاية صحية نفسية من الواقع العملي، تعمل بشكل منهجي على تقييم دقة النماذج اللغوية والتحيز الديموغرافي من خلال استبدال متغيرات المرضى لالتقاط الفروق السريرية الدقيقة التي غالباً ما تغفلها معايير الاختبارات المرجعية التقليدية.

Max Lamparth, Declan Grabb, Amy Franks, Scott Gershan, Kaitlyn N. Kunstman, Aaron Lulla, Monika Drummond Roots, Manu Sha (…)2026-02-18
💬 NLP

Can Multimodal LLMs Perform Time Series Anomaly Detection?

تبحث هذه الورقة في الإمكانات غير المستكشفة لنماذج اللغات الكبيرة متعددة الوسائط في اكتشاف الشذوذ في السلاسل الزمنية من خلال تقديم معيار VisualTimeAnomaly لتقييم قدرات التعلم الصفري عبر سيناريوهات متنوعة، واقتراح إطار عمل TSAD-Agents، وهو إطار متعدد الوكلاء يجمع بشكل تآزري بين الطرق التقليدية ونماذج اللغات الكبيرة متعددة الوسائط لتحقيق اكتشاف تلقائي وتكيفي للشذوذ.

Xiongxiao Xu, Haoran Wang, Yueqing Liang, Philip S. Yu, Yue Zhao, Kai Shu2026-02-18