💬 NLP

A Fine-Tuned BERT Classifier for Personal-Letter Titles in Late-Ming and Early-Qing Collected Works

تقدم هذه الورقة "ليبتون" (Lepton)، وهو مصنف BERT تم ضبطه بدقة وتدريبه على 5,438 عنواناً تم تصنيفها يدوياً لثلاثة وثلاثين من أدباء أواخر عصر أسرة مينغ وأوائل عصر أسرة تشينغ، والذي نجح في التمييز بين الرسائل الشخصية والمقدمات التي قد تختلط بها، وقد تم نشره لتحديد ما يقرب من 55,000 رسالة لمنصة "مينغ" للرسائل عبر قاعدة بيانات الصين للسير الذاتية.

Queenie Luo2026-05-25
💬 NLP

As X, Do Y: How Persona and Task Combine in Instruction-Tuned LLMs

بينما تُظهر هذه الورقة أن تعليمات الشخصية والمهمة في النماذج اللغوية الكبيرة المضبوطة بالتعليمات تُظهر تفكيكاً خطياً جمعياً واضحاً عند الانتقال من المطالبة إلى الإجابة في المجرى المتبقي، إلا أنها تثبت في النهاية أن هذه الجمعية المحلية لا تُمكّن من ضغط مطالبات الدور في متجه واحد مخزن مؤقتاً لأن التوليد المشروط بالشخصية يعتمد على آلية انتباه موزعة لا يمكن محاكاتها عن طريق الاستبدال المحلي للمجرى المتبقي.

Eric Xu2026-05-25
💬 NLP

When Symptoms Are Not Enough: Evidence-Weighting Patterns in Large Language Model Psychiatric Screening

تقيم هذه الدراسة أداء خمسة من نماذج اللغات الكبيرة المتطورة على معيار مرجعي مرتكز على مقابلة التشخيص والاختبار الهيكلي (SCID) لـ 555 مقابلة نفسية، كاشفةً أنه في حين تُظهر نماذج مثل GPT-4.1 وGPT-5 Mini إمكانات واعدة للفحص القابل للتوسع، فإن ميلها إلى استبعاد أدلة الأعراض الصريحة عند وجود وظائف محفوظة أو سياقات وقائية يؤدي إلى أخطاء سلبية كاذبة كبيرة وتفاوتات ديموغرافية يجب معالجتها قبل النشر السريري.

Jianfeng Zhu, Megan Korhummel, Ruoming Jin, Karin G. Coifman2026-05-25
💬 NLP

Same Model, Different Weakness: How Language and Modality Reshape the Jailbreak Attack Surface in Frontier MLLMs

تكشف هذه الدراسة أن ثغرات كسر الحماية في النماذج اللغوية الكبيرة متعددة الوسائط الرائدة ليست موحدة عبر اللغات، مما يثبت أن الانتقال من الإنجليزية إلى الإسبانية يغير بشكل جذري سطح الهجوم من خلال إضعاف هجمات التأطير اللغوي وتقوية الهجمات البصرية، مما يبطل تصنيفات السلامة المستمدة من التقييمات أحادية اللغة.

Casey Ford, Madison Van Doren, Sicheng Jin, Emily Dix2026-05-25
💬 NLP

What Does the Server See? Understanding Privacy Leakage from Large Language Models in Split Inference

تكشف هذه الورقة عن ثغرات خصوصية حرجة في الاستدلال المجزأ للنماذج اللغوية الكبيرة من خلال تقديم ActInv، وهي طريقة تعيد بناء مدخلات العميل من التنشيطات الوسيطة رغم الدفاعات الشائعة، وتقترح مقياس عامل تضخيم الاضطراب (PAF) ودفاع PriPert لتحليل وتخفيف مخاطر التسريب هذه بشكل منهجي.

Mingyuan Fan, Yu Liu, Fuyi Wang, Cen Chen2026-05-25
💬 NLP

Autonomous Frontier-Based Exploration with VLM Guidance

تقدم هذه الورقة مسار استكشاف ذاتي خفيف الوزن وخالٍ من التدريب، يستفيد من النماذج اللغوية الرؤيوية للقيام باتخاذ قرارات استراتيجية عالية المستوى من خلال تحليل المطالبات متعددة الوسائط للخرائط والصور المرئية، مما يؤدي إلى تحسين تغطية الخرائط بنسبة تصل إلى 24% مقارنة بالطرق الهندسية الاستدلالية الحالية في البيئات غير المعروفة.

Aarush Aitha, Avideh Zakhor2026-05-25
💬 NLP

Positional Failures in Long-Context LLMs: A Blind Spot in Reasoning Benchmarks

تكشف هذه الورقة عن فجوة حرجة في معايير تقييم الاستدلال في السياقات الطويلة من خلال إثبات أن التقييمات السائدة تفشل في ضبط موضع المهمة، مما يؤدي إلى انخفاض كبير في الأداء عندما توضع المهام في منتصف السياقات الطويلة بسبب تداخل الحشو، وتقترح إطار عمل تقييم تعفن السياق (CRE) لمعالجة هذه النقطة العمياء الهيكلية.

Chuyifei Zhang, Hongyu Cui, Xiaowen Huang, Jitao Sang2026-05-25
💬 NLP

Robust LLM Watermarking with Minimal Semantic Distortion for IP Protection

تقدم الورقة البحثية SAFESEAL، وهو إطار عمل جديد للعلامات المائية المشروطة بالمفتاح يحمي النماذج اللغوية الكبيرة المملوكة من سرقة الملكية الفكرية من خلال تحقيق معدلات كشف عالية ومتانة ضد الهجمات مع الحفاظ على أدنى حد من التشويه الدلالي والاتساق الواقعي عبر استبدال المرادفات المدرك للسياق وكاشف تبايني.

Kieu Dang, Phung Lai, NhatHai Phan, Yelong Shen, Ruoming Jin2026-05-25
💬 NLP

Self-Improving In-Context Learning

تقترح هذه الورقة طريقة لمعايرة وقت الاختبار للتعلم داخل السياق، تعمل على تحسين تضمينات المطالبات المستمرة من خلال تعظيم مؤشر ثقة ذاتي التوجيه مستمد من الاحتمالات اللوغاريتمية للنموذج، مما يؤدي إلى تحسين الأداء في كل من مهام التصنيف والتوليد دون الحاجة إلى الضبط الدقيق، أو توليد الرموز، أو بيانات خارجية.

Baturay Saglam, Dionysis Kalogerias2026-05-25
🤖 machine learning

Multi-Gate Residuals

تقترح الورقة البحثية بنية "البواقي متعددة البوابات" (MGR)، وهي بنية مبتكرة تعمل على تثبيت مقاييس التنشيط في الشبكات المتبقية العميقة باستخدام آلية تسجيل وبوابة مع تجميع الانتباه، مما يحقق تحسينات في الأداء دون عبء الاتصال المرتبط ببواقي الانتباه.

Zhizhan Zheng, Feiyun Zhang, Shuchun Liu, Tian Xia, Xi Liu, Dasheng Hu, Hongquan Zhou2026-05-25