🤖 machine learning

ProtSent: Protein Sentence Transformers

تقدم الورقة البحثية ProtSent، وهو إطار عمل للضبط الدقيق التبايني يعمل على تكييف نماذج لغة البروتين لتصبح نماذج تضمين عامة الأغراض، مما يحسن الأداء بشكل كبير عبر 23 مهمة لاحقة تتعلق بوظيفة البروتين وبنيته وتطوره دون الحاجة إلى إشراف خاص بكل مهمة.

Dan Ofer, Oriel Perets, Michal Linial, Nadav Rappoport2026-05-11
🤖 machine learning

Benchmarked Yet Not Measured -- Generative AI Should be Evaluated Against Real-World Utility

تجادل هذه الورقة بأن الفجوة بين الأداء القوي للذكاء الاصطناائي التوليدي في الاختبارات المعيارية وفائدته المحدودة في العالم الحقيقي تنبع من ممارسات تقييم معيبة، وتقترح إطار عمل SCU-GenEval لتحويل التقييم نحو قياس التحسينات المستدامة في النتائج البشرية ضمن سياقات نشر محددة.

Ishani Mondal, Shweta Bhardwaj2026-05-11
💬 NLP

MELD: Multi-Task Equilibrated Learning Detector for AI-Generated Text

تقدم الورقة البحثية MELD، وهو كاشف متعدد المهام للنصوص المولدة بواسطة الذكاء الاصطناعي يعزز المتانة ضد الهجمات، وتحولات النطاق، والمولدات غير المرئية من خلال توظيف الإشراف المساعد، وتقطير المعرفة، وتصنيف السلبيات الصعبة، محققاً أداءً هو الأفضل في مجاله على المقاييس المرجعية مع الحفاظ على كفاءة الكاشف الثنائي القياسي.

Chenjun Li, Cheng Wan, Johannes C. Paetzold2026-05-11
💬 NLP

Bridging Textual Profiles and Latent User Embeddings for Personalization

تقدم الورقة البحثية إطار عمل BLUE، وهو إطار للتعلم التعزيزي يوحد بين ملفات تعريف المستخدم النصية القابلة للتفسير وبين التضمينات الكامنة التمييزية من خلال محاذاة ملفات التعريف القائمة على اللغة مع إشارات المكافأة في فضاء التضمين، مما يحقق أداءً فائقاً في التوصية المتسلسلة لصفرية المحتوى ونقل النطاق عبر المجالات مع تعزيز السياق الشخصي للإجابة على الأسئلة.

Zhaoxuan Tan, Xiang Zhai, Yan Zhu, Meng Jiang, Mohamed Hammad2026-05-11
💬 NLP

GSM-SEM: Benchmark and Framework for Generating Semantically Variant Augmentations

تقدم هذه الورقة البحثية إطار عمل GSM-SEM، وهو إطار عشوائي يولد متغيرات معيارية متنوعة دلاليًا ومعدلة واقعيًا للتخفيف من تحيز الحفظ في تقييمات النماذج اللغوية الكبيرة، مما يكشف عن انخفاضات كبيرة في الأداء في النماذج المتطورة عند اختبارها على هذه المجموعات من البيانات المُعاد توليدها ديناميكيًا.

Jyotika Singh, Fang Tu, Aziza Mirzadova, Amit Agarwal, Hitesh Laxmichand Patel, Sandip Ghoshal, Miguel Ballesteros, Yass (…)2026-05-11
💬 NLP

Self-Consolidating Language Models: Continual Knowledge Incorporation from Context

تقترح الورقة البحثية نماذج لغوية ذاتية التماسك (SCoL)، وهو إطار عمل لما بعد التدريب يُمكّن النماذج اللغوية الكبيرة من دمج معارف جديدة باستمرار في أوزانها عبر توليد تعليمات تحديث متفرقة ومحددة لكل طبقة من خلال التعلم المعزز الميتافيزيقي، مما يؤدي إلى تحسين الاحتفاظ بالمعلومات وتقليل التداخل مقارنة بالنماذج المرجعية الحالية.

Zekun Wang, Anant Gupta, Zihan Dong, Christopher J. MacLellan2026-05-11
💬 NLP

The Translation Tax Is Not a Scalar: A Counterfactual Audit of English-Source Cue Inheritance in Chinese Multilingual Benchmarks

تتحدى هذه الورقة البحثية مفهوم "ضريبة الترجمة" الموحدة في معايير القياس من الإنجليزية إلى الصينية من خلال إثبات أن تضخم الدرجات ليس تأثيراً قياسياً، بل هو ظاهرة معقدة تعتمد على العناصر وتدفعها مخاطر صلاحية محددة وتفاعلات بين عائلات النماذج، وتقترح في نهاية المطوي بروتوكولاً جديداً للتطبيع وقائمة مراجعة للإبلاقات لمعالجة هذه القضايا الدقيقة.

Zezheng Lin, Fengming Liu, Handi Li2026-05-11
💬 NLP

Securing Computer-Use Agents: A Unified Architecture-Lifecycle Framework for Deployment-Grounded Reliability

تقترح هذه الورقة إطار عمل موحداً للهيكلية ودورة الحياة لتعزيز الموثوقية القائمة على النشر لوكلاء استخدام الحاسوب، وذلك من خلال الربط المنهجي بين طبقات الإدراك واتخاذ القرار والتنفيذ وبين مراحل الإنشاء والنشر والتشغيل والصيانة لإدارة تعرض السلطة وأنماط الفشل والإشراف على التحكم بشكل أفضل.

Zejian Chen, Zhanyuan Liu, Chaozhuo Li, Mengxiang Han, Songyang Liu, Litian Zhang, Feng Gao, Yiming Hei, Xi Zhang2026-05-11
💬 NLP

Beyond LoRA vs. Full Fine-Tuning: Gradient-Guided Optimizer Routing for LLM Adaptation

تقدم هذه الورقة MoLF، وهو إطار عمل موحد للضبط الدقيق يقوم بتوجيه تحديثات التدرج ديناميكياً بين الضبط الدقيق الكامل والتكيف منخفض الرتبة على مستوى المحسن للتغلب على القيود الهيكلية للنهجات الثابتة، محققاً أداءً متفوقاً أو مكافئاً عبر مهام وأحجام نماذج متنوعة مع توفير نسخة فعالة من حيث استهلاك الذاكرة.

Haozhan Tang, Xiuqi Zhu, Xinyin Zhang, Boxun Li, Virginia Smith, Kevin Kuo2026-05-11
💬 NLP

Region4Web: Rethinking Observation Space Granularity for Web Agents

يقدم البحث إطار عمل Region4Web، الذي يعيد تعريف ملاحظة الوكيل الويب من مستوى العناصر إلى مستوى المناطق الوظيفية من خلال التفكيك الهرمي ومسار PageDigest المستمر، محققاً معدلات نجاح أعلى للمهام وتقليلاً في أطوال الملاحظات على معيار WebArena عبر نماذج لغوية كبيرة متنوعة.

Donguk Kwon, Dongha Lee2026-05-11