💬 NLP

Capability-Based Scaling Trends for LLM-Based Red-Teaming

تستقصي هذه الورقة تحدي "من الضعيف إلى القوي" في عمليات اختبار الاختراق لنماذج اللغات الكبيرة (LLM) من خلال إثبات أن معدلات نجاح الهجوم تنخفض بشكل حاد عندما تتجاوز قدرة النموذج المستهدف قدرة المهاجم، مما يؤدي إلى اقتراح "منحنى توسع كسر الحماية" للتنبؤ بالهشاشة بناءً على فجوة القدرات.

Alexander Panfilov, Paul Kassianik, Maksym Andriushchenko, Jonas Geiping2026-02-10
💬 NLP

Can We Infer Confidential Properties of Training Data from LLMs?

تقدم هذه الورقة PropInfer، وهو معيار لتقييم ما إذا كانت النماذج اللغوية الكبيرة (LLMs) عرضة لهجمات استنتاج الخصائص، وتثبت من خلال طرق هجوم جديدة أن النماذج اللغوية الكبيرة يمكنها بالفعل تسريب معلومات سرية حساسة على مستوى مجموعة البيانات أثناء عملية الضبط الدقيق.

Pengrun Huang, Chhavi Yadav, Kamalika Chaudhuri, Ruihan Wu2026-02-10
💬 NLP

MedVAL: Toward Expert-Level Medical Text Validation with Language Models

تقدم الورقة البحثية MedVAL، وهي طريقة تقطير ذاتي الإشراف ومعيار مرجعي يُمكّن النماذج اللغوية من التحقق من الدقة الواقعية للنصوص الطبية بأداء يضاهي مستوى الخبراء دون الحاجة إلى بيانات مصنفة من قبل الأطباء أو مخرجات مرجعية.

Asad Aali, Vasiliki Bikia, Maya Varma, Nicole Chiou, Sophie Ostmeier, Arnav Singhvi, Magdalini Paschali, Ashwin Kumar, A (…)2026-02-10
💬 NLP

STITCH: Simultaneous Thinking and Talking with Chunked Reasoning for Spoken Language Models

تُعد STITCH طريقة توليد مبتكرة لنماذج اللغة المنطوقة تعمل على تقليل زمن الاستجابة عبر التداخل بين قطع التفكير غير المنطوقة وقطع الاستجابة المنطوقة، مما يسمح للنموذج بـ "التفكير" أثناء تشغيل الصوت للمستخدم في آن واحد.

Cheng-Han Chiang, Xiaofei Wang, Linjie Li, Chung-Ching Lin, Kevin Lin, Shujie Liu, Zhendong Wang, Zhengyuan Yang, Hung-y (…)2026-02-10
💬 NLP

R-Stitch: Dynamic Trajectory Stitching for Efficient Reasoning

يُعد R-Stitch إطار عمل فك تشفير هجينًا لا يتطلب تدريبًا، يعمل على تسريع استدلال "سلسلة الأفكار" (Chain-of-Thought) عبر استخدام الإنتروبيا على مستوى الرمز لتفويض الرموز ذات عدم اليقين المنخفض ديناميكيًا إلى نموذج لغوي صغير، مع حجز النموذج اللغوي الكبير للرموز المعقدة ذات الإنتروبيا العالية، مما يقلل من تعقيد كل رمز ومن طول المسار الإجمالي مع حد أدنى من فقدان الدقة.

Zhuokun Chen, Zeren Chen, Jiahao He, Lu Sheng, Mingkui Tan, Jianfei Cai, Bohan Zhuang2026-02-10
💬 NLP

LegalΔΔ: Enhancing Legal Reasoning in LLMs via Reinforcement Learning with Chain-of-Thought Guided Information Gain

يُعد LegalΔ إطاراً للتعلم التعزيزي يعمل على تعزيز دقة وقابلية التفسير في الاستدلال القانوني لدى النماذج اللغوية الكبيرة من خلال تعظيم كسب المعلومات بين الإجابات المباشرة وسلسلة الأفكار، وذلك باستخدام تقنية تقطير المعرفة من DeepSeek-R1 وآلية مكافأة متعددة الأبعاد.

Xin Dai, Buqiang Xu, Zhenghao Liu, Yukun Yan, Huiyuan Xie, Xiaoyuan Yi, Shuo Wang, Ge Yu2026-02-10
💬 NLP

DeepScholar-Bench: A Live Benchmark and Automated Evaluation for Generative Research Synthesis

تقدم الورقة البحثية DeepScholar-bench، وهو معيار حي وإطار تقييم مؤتمت مصمم لتقييم قدرة أنظمة الذكاء الاصطناعي على إجراء التوليف البحثي التوليدي من خلال استرجاع وتوليف المعلومات من أوراق ArXiv الحديثة لإنشاء تقارير طويلة وموثقة بالمصادر.

Liana Patel, Negar Arabzadeh, Harshit Gupta, Ankita Sundar, Ion Stoica, Matei Zaharia, Carlos Guestrin2026-02-10
💬 NLP

Cognitive Linguistic Identity Fusion Score (CLIFS): A Scalable Cognition-Informed Approach to Quantifying Identity Fusion from Text

تقدم الورقة البحثية "درجة الاندماج الهوياتي اللغوي المعرفي" (CLIFS)، وهي مقياس آلي مبتكر يستفيد من اللسانيات المعرفية والنماذج اللغوية الكبيرة لقياس الاندماج النفسي للذات مع الكيانات الخارجية من خلال تحليل النصوص، مما يظهر دقة وقابلية للتوسع تتفوق على الطرق التقليدية والنهج الآلية الحالية.

Devin R. Wright, Jisun An, Yong-Yeol Ahn2026-02-10
💬 NLP

OpenGVL -- Benchmarking Visual Temporal Progress for Data Curation

يُعد OpenGVL معياراً جديداً صُمم لتقييم واستخدام نماذج الرؤية واللغة للتنبؤ بتقدم المهام الزمنية، مما يوفر أداة لتنظيم البيانات آلياً في مجال الروبوتات مع الكشف عن فجوة أداء كبيرة بين النماذج مفتوحة المصدر والنماذج مغلقة المصدر.

Paweł Budzianowski, Emilia Wiśnios, Michał Tyrolski, Gracjan Góral, Igor Kulakov, Viktor Petrenko, Krzysztof Walas2026-02-10