🤖 machine learning

Consistently Informative Soft-Label Temperature for Knowledge Distillation

تقترح الورقة البحثية طريقة CIST، وهي طريقة لتقطير المعرفة توظف درجات حرارة تكيفية على مستوى العينة لكل من شبكتي المعلم والطالب لتوليد تسميات ناعمة غنية بالمعلومات بشكل متسق وإعادة وزن هدف التقطير ديناميكيًا، مما يتغلب على قيود نهج درجة الحرارة الثابتة ويحسن الأداء عبر مهام الرؤية واللغة مع عبء حسابي ضئيل للغاية.

Hoang-Chau Luong, Nghia Van Vo, Kaiqi Zhao, Lingwei Chen2026-05-21
💻 computer science

Security Document Classification with a Fine-Tuned Local Large Language Model: Benchmark Data and an Open-Source System

يقدم هذا البحث TorchSight، وهو نظام محلي مفتوح المصدر يستخدم نموذج Qwen 3.5 27B مضبوطاً بدقة ومدرباً على أكثر من 78,000 عينة، والذي يحقق دقة أعلى بكثير (95.0%) في تصنيف الوثائق الأمنية مقارنة بالبدائل السحابية التجارية مع ضمان بقاء البيانات تحت السيطرة المحلية.

Ivan Dobrovolskyi2026-05-21
💬 NLP

DEL: Digit Entropy Loss for Numerical Learning of Large Language Models

تقدم هذه الورقة "فقدان الإنتروبيا الرقمية" (Digit Entropy Loss - DEL)، وهو هدف تدريب مبتكر يعيد صياغة تحسين الإنتروبيا غير الخاضع للإشراف إلى إطار عمل خاضع للإشراف وخالٍ من المسافة، وذلك لتحسين دقة النماذج اللغوية الكبيرة في التنبؤ بكل من الأعداد الصحيحة والأعداد العشرية عبر مهام الاستدلال الرياضي وتوليد الكود البرمجي.

Zhaohui Zheng, Chenhang He, Shihao Wang, Yuxuan Li, Ming-Ming Cheng, Lei Zhang2026-05-21
💻 computer science

Latent Space Guided Scenario Sampling for Multimodal Segmentation Under Missing Modalities

تقترح هذه الورقة استراتيجية تدريب مبتكرة للتجزئة الدلالية متعددة الوسائط في ظل فقدان بعض الوسائط، حيث توجه عملية الضبط الدقيق نحو سيناريوهات توافر الوسائط الأكثر غنىً بالمعلومات من خلال تعلم توزيع أخذ العينات من الفضاء الكامن مسبق التدريب بناءً على تشوه التمثيل، مما يؤدي إلى تفوقها على طرق الضبط الدقيق القياسية وطرق التكيف القائمة على تقنية LoRA.

Irem Ulku, Ö. Özgür Tanrıöver, Erdem Akagündüz2026-05-21
🤖 machine learning

Nonlocal operator learning for fMRI encoding and decoding tasks

تقدم هذه الورقة إطار عمل لمؤثر تكامل عصبي كامن يستفيد من السياق الزماني والمكاني غير الموضعي لنمذجة ديناميكيات التصوير بالرنين المغناطيسي الوظيفي بفعالية، مما يثبت أن النوافذ الزمنية الأكبر وتسجيلات الدماغ الكاملة تحسن بشكل كبير كلاً من أداء فك التشفير والترميز للمحفز مع إنتاج تمثيلات كامنة أكثر هيكلية.

Andreas Kramer, Saugat Acharya, Alice Giola, Emanuele Zappala2026-05-21
💬 NLP

Mechanics of Bias and Reasoning: Interpreting the Impact of Chain-of-Thought Prompting on Gender Bias in LLMs

تبحث هذه الورقة في تأثير تقنية "سلسلة الأفكار" (Chain-of-Thought) على التحيز الجنساني في النماذج اللغوية الكبيرة، وتخلص إلى أنه على الرغم من قدرتها على موازنة آليات انتباه معينة بشكل سطحي، إلا أنها تفشل في الحد من التحيز فعلياً لأن الصور النمطية الجنسانية الكامنة تظل متجذرة في التمثيلات الخفية، وأن التحسينات الملحوظة تنبع من حفظ البيانات وليس من التفكير الحقيقي.

Edie Pearman, Sophia Osborne, Mira Kandlikar-Bloch, Mina Arzaghi, Florian Carichon, Golnoosh Farnadi2026-05-21
💻 computer science

OSCToM: RL-Guided Adversarial Generation for High-Order Theory of Mind

تقدم هذه الورقة OSCToM، وهو نهج موجه بالتعلم التعزيزي يقوم بتوليد سيناريوهات صراع بين المراقب والذات لتعزيز قدرة النماذج اللغوية الكبيرة على استنتاج نظرية العقل بشكل كبير، محققاً دقة بنسبة 76% على معيار FANToM القائم على عدم تماثل المعلومات مقارنة بـ 0.2% بالطرق السابقة.

Sharmin Sultana Srishty, Kazi Mahathir Rahman, Malaika Parizat Sakkhi, Samia Shahid Prianna, Shaikhul Islam Sinat2026-05-21
💻 computer science

AgentCo-op: Retrieval-Based Synthesis of Interoperable Multi-Agent Workflows

تُعد AgentCo-op إطار عمل قائمًا على الاسترجاع يعمل على تخليق سير عمل متعدد الوكلاء قابل للتشغيل البيني من خلال تركيب أدوات ووكلاء قابلين لإعادة الاستخدام عبر تسليم مخرجات نمطية وإصلاح ذاتي محلي، مما يُمكّن من الاكتشاف التعاوني الفعال في المجالات العلمية مفتوحة النهايات مع التفوق على النماذج المرجعية في مختلف الاختبارات المعيارية بتكاليف مخفضة.

Shuaike Shen, Wenduo Cheng, Shike Wang, Mingqian Ma, Jian Ma2026-05-21
🤖 machine learning

Group-Algebraic Tensors: Provably-optimal Equivariant Learning and Physical Symmetry Discovery

تقدم هذه الورقة جبر التنسور G\star_G، وهو إطار عمل يحول التكافؤ من قيد معماري إلى خاصية جبرية جوهرية، مما يتيح تقريباً للتنسور يحافظ على التماثل بشكل أمثل ومثبت، وتنبؤات ذات صيغة مغلقة لكل تمثيل غير قابل للاختزال، واكتشافاً للتماثلات الفيزيائية القائم على البيانات دون الحاجة إلى معرفة مسبقة بميكانيكا الكم.

Paulina Hoyos, Shashanka Ubaru, Dongsung Huh, Vasileios Kalantzis, Kenneth L. Clarkson, Misha Kilmer, Haim Avron, Lior H (…)2026-05-21
🤖 machine learning

Weight Decay Regimes in Grokking Transformers: Cheap Online Diagnostics

تُثبت هذه الورقة أن اضمحلال الوزن يعمل كمعلم تحكم حاسم يحكم الانتقال بين الحفظ، والتعميم (التفهم العميق/grokking)، والانهيار في نماذج المحولات (transformers) المدربة على الحساب النمطي، وتُقدم وسيلتين تشخيصيتين آنيتين فعالتين حاسوبياً تعتمدان على تنشيطات الانتباه لتتبع هذه الديناميكيات عبر مختلف أحجام النماذج وبنياتها.

Lucky Verma2026-05-21