💬 NLP

Attention Smoothing Is All You Need For Unlearning

تقترح الورقة البحثية "تنعيم الانتباه لغرض النسيان" (ASU)، وهو إطار عمل يعمل بفعالية على محو المحتوى الحساس المحفوظ في النماذج اللغوية الكبيرة من خلال تسطيح توزيعات الانتباه عبر قياس درجة الحرارة، مما يحقق نسيانًا قويًا مع الحفاظ على فائدة النموذج وتماسك الاستجابة.

Saleh Zare Zade, Xiangyu Zhou, Sijia Liu, Dongxiao Zhu2026-03-03
💬 NLP

Efficient Extractive Summarization with MAMBA-Transformer Hybrids for Low-Resource Scenarios

تقدم هذه الورقة أول بنية هجينة بين "مامبا" (Mamba) و"ترانسفورمر" (Transformer) لعملية التلخيص الاستخراجي، والتي تستفيد من نماذج فضاء الحالة ذات الزمن الخطي لمعالجة المستندات الكاملة دون بتر، محققةً تحسينات كبيرة في مقاييس (ROUGE) وسرعة أكبر في الاستدلال في سيناريوهات الموارد المنخفضة مقارنة بالطرق الحالية.

Nisrine Ait Khayi2026-03-03
💬 NLP

Individual Turing Test: A Case Study of LLM-based Simulation Using Longitudinal Personal Data

تقدم هذه الورقة "اختبار تورينج الفردي" باستخدام بيانات رسائل خاصة تمتد لعشر سنوات لتقييم طرق محاكاة النماذج اللغوية الكبيرة المختلفة، كاشفةً أنه بينما تفشل النماذج الحالية في محاكة فرد معين بشكل مقنع أمام معارفه، إلا أنها تظهر نقاط قوة متميزة في التقاط الأسلوب اللغوي مقابل المعرفة الشخصية اعتماداً على ما إذا كانت الأساليب المستخدمة بارامترية (الضبط الدقيق) أم غير بارامترية (الاسترجاع المعزز أو الذاكرة).

Minghao Guo, Ziyi Ye, Wujiang Xu, Xi Zhu, Wenyue Hua, Dimitris N. Metaxas2026-03-03
💬 NLP

JailNewsBench: Multi-Lingual and Regional Benchmark for Fake News Generation under Jailbreak Attacks

تقدم هذه الورقة JailNewsBench، وهو أول معيار متعدد اللغات وإقليمي مصمم لتقييم مدى عرضة النماذج اللغوية الكبيرة لتوليد الأخبار الزائفة الناجم عن كسر الحماية (jailbreak)، مما يكشف عن اختلالات أمنية كبيرة عبر اللغات والمناطق ويسلط الضوء على محدودية الدفاع ضد مثل هذه الهجمات في مجموعات البيانات الأمنية الحالية.

Masahiro Kaneko, Ayana Niwa, Timothy Baldwin2026-03-03
💬 NLP

I Can't Believe It's Not Robust: Catastrophic Collapse of Safety Classifiers under Embedding Drift

تكشف هذه الورقة أن مصنفات السلامة التي تعتمد على التضمينات المجمدة تعاني من تدهور كارثي في الأداء وإخفاقات صامتة خطيرة بسبب الانزياح الطفيف في التضمين في النماذج المضبوطة بالتعليمات، مما يتحدى الافتراض بأن آليات السلامة تظل قوية عبر تحديثات النماذج.

Subramanyam Sahoo, Vinija Jain, Divya Chaudhary, Aman Chadha2026-03-03
💬 NLP

Catalyst-Agent: Autonomous heterogeneous catalyst screening and optimization with an LLM Agent

تقدم هذه الورقة Catalyst-Agent، وهو وكيل ذاتي التشغيل مدعوم بنماذج اللغات الكبيرة (LLM) يستفيد من بروتوكول سياق النموذج (Model Context Protocol) والشبكات العصبية الرسومية لفحص وتحسين واقتراح محفزات غير متجانسة جديدة لتفاعلات رئيسية مثل تفاعل اختزال الأكسجين (ORR)، وتفاعل اختزال النيتروجين (NRR)، وتفاعل اختزال ثاني أكسيد الكربون (CO2RR) بأقل قدر من التدخل البشري.

Achuth Chandrasekhar, Janghoon Ock, Amir Barati Farimani2026-03-03
💬 NLP

Truth as a Trajectory: What Internal Representations Reveal About Large Language Model Reasoning

تقدم هذه الورقة البحثية "الحقيقة كمسار" (TaT)، وهي طريقة جديدة للتفسير تحلل الإزاحات الهندسية على مستوى الطبقات في النماذج اللغوية الكبيرة بدلاً من التنشيطات الساكنة، مما يميز بفعالية بين الاستدلال الصحيح والأنماط الزائفة من خلال التغلب على قيود الميزات متعددة الدلالات والمغالطات اللفظية.

Hamed Damirchi, Ignacio Meza De la Jara, Ehsan Abbasnejad, Afshar Shamsi, Zhen Zhang, Javen Shi2026-03-03
💬 NLP

MetaState: Persistent Working Memory for Discrete Diffusion Language Models

تقدم الورقة البحثية MetaState، وهو تعزيز تكراري خفيف الوزن يزود نماذج لغة الانتشار المنفصلة المجمدة بذاكرة عمل مستمرة لحل مشكلة "جزيرة المعلومات"، مما يحسن الاتساق عبر الخطوات ودقة التوليد دون زيادة في معلمات الهيكل الأساسي.

Kejing Xia, Mingzhe Li, Lixuan Wei, Zhenbang Du, Xiangchi Yuan, Qirui Jin, Wenke Lee2026-03-03
💬 NLP

PanCanBench: A Comprehensive Benchmark for Evaluating Large Language Models in Pancreatic Oncology

يُعد PanCanBench معياراً شاملاً يتكون من 282 سؤالاً حقيقياً لمرضى سرطان البنكرياس و3,130 معياراً مستمداً من الخبراء، وهو يكشف عن تباينات كبيرة في الدقة الواقعية والاكتمال لـ 22 نموذجاً من النماذج اللغوية الكبيرة، مما يسلط الضوء على أن ارتفاع درجات المعايير وتكامل البحث عبر الويب لا يضمنان بالضرورة السلامة السريرية أو تقليل الهلوسة.

Yimin Zhao, Sheela R. Damle, Simone E. Dekker, Scott Geng, Karly Williams Silva, Jesse J Hubbard, Manuel F Fernandez, Fa (…)2026-03-03
💬 NLP

Constructing Synthetic Instruction Datasets for Improving Reasoning in Domain-Specific LLMs: A Case Study in the Japanese Financial Domain

تقدم هذه الدراسة منهجية عامة لبناء مجموعات بيانات تعليمات اصطناعية عالية الجودة مع آثار استدلال تسلسل الأفكب (Chain-of-Thought) بدءاً من مفردات متخصصة في مجال معين، مما يثبت فعاليتها في تعزيز قدرات الاستدلال لنماذج اللغات الكبيرة (LLMs) في المجال المالي الياباني من خلال مجموعة بيانات تبلغ 9.5 مليار توكن.

Yuma Okochi, Fabio Milentiansen Sim, Tomoyasu Okada2026-03-03