💬 NLP

Balancing Understanding and Generation in Discrete Diffusion Models

تقترح الورقة البحثية نموذج XDLM، وهو نموذج انتشار منفصل مبتكر يوحد بين نماذج القناع (Masked) والضجيج الموحد (Uniform-noise) من خلال نواة ضجيج ثابتة لتحقيق فهم دلالي فائق وتوليد عالي الجودة في خطوات معدودة في آن واحد، مما يعزز بفعالية جبهة باريتو للأداء عبر مهام النصوص والصور.

Yue Liu, Yuzhong Zhao, Zheyong Xie, Qixiang Ye, Jianbin Jiao, Yao Hu, Shaosheng Cao, Yunfan Liu2026-02-03
⚡ electrical engineering

Causally Disentangled Contrastive Learning for Multilingual Speaker Embeddings

تتقصى هذه الورقة وجود التسرب الديموغرافي في تمثيلات المتحدث ذاتية الإشراف وتقيم استراتيجيتين لإزالة الانحياز، كاشفةً أنه بينما يمكن للتدريب التنافسي والاختناقات السببية تقليل معلومات النوع الاجتماعي والعمر واللكنة، إلا أنها تؤدي حتماً إلى مقايضات كبيرة مع أداء التحقق من هوية المتحدث.

Mariëtte Olijslager, Seyed Sahand Mohammadi Ziabari, Ali Mohammed Mansoor Alsahag2026-02-03
💬 NLP

When Domains Interact: Asymmetric and Order-Sensitive Cross-Domain Effects in Reinforcement Learning for Reasoning

تقدم هذه الورقة أول تحليل منهجي لـ "تحسين السياسة النسبي للمجموعات" (GRPO) عبر مجالات استدلال متعددة، كاشفةً أن أداء التدريب يتميز بعدم تماثل واضح، وحساسية للترتيب، واعتماد على الاستراتيجية، مما يستلزم تصميمات تدريب مدركة للمجال ومدركة للترتيب.

Wang Yang, Shouren Wang, Chaoda Song, Chuang Ma, Xinpeng Li, Nengbo Wang, Kaixiong Zhou, Vipin Chaudhary, Xiaotian Han2026-02-03
📊 statistics

Context Dependence and Reliability in Autoregressive Language Models

تقدم هذه الورقة RISE، وهي طريقة مبتكرة تقيس التأثير الفريد لعناصر السياق الفردية في النماذج اللغوية ذات التوليد الذاتي للتغلب على مشكلات عدم الاستقرار والتكرار في تقنيات التفسير التقليدية، مما يعزز موثوقية وقابلية تفسير مخرجات النماذج اللغوية الكبيرة.

Poushali Sengupta, Shashi Raj Pandey, Sabita Maharjan, Frank Eliassen2026-02-03
💬 NLP

Rethinking Selective Knowledge Distillation

تحلل هذه الورقة بشكل منهجي عملية تقطير المعرفة الانتقائي عبر محاور الموضع والفئة والعينة لتقديم اختيار الموضع الموجه بإنتروبيا الطالب (SE-KD) وامتداده متعدد المحاور (SE-KD 3X)، والذي يحسن الدقة، والالتزام بالمهام، وكفاءة الذاكرة بشكل كبير، مع تقليل وقت التدريب ومتطلبات التخزين بشكل جذري مقارنة بالتقطير الكثيف.

Almog Tavor, Itay Ebenspanger, Neil Cnaan, Mor Geva2026-02-03
💬 NLP

Ebisu: Benchmarking Large Language Models in Japanese Finance

تقدم هذه الورقة Ebisu، وهو معيار مرجعي جديد يتكون من مهمتين تم تعليمهما من قبل خبراء، صُممتا لتقييم التحديات التي تواجهها النماذج اللغوية الكبيرة في فهم الفروق اللغوية والثقافية المعقدة للتمويل الياباني، مما يكشف أن حتى النماذج المتطورة تعاني في استخراج الالتزامات الضمنية والمصطلحات الهرمية رغم الحجم أو التكيف.

Xueqing Peng, Ruoyu Xiang, Fan Zhang, Mingzi Song, Mingyang Jiang, Yan Wang, Lingfei Qian, Taiki Hara, Yuqing Guo, Jimin (…)2026-02-03
💬 NLP

A Relative-Budget Theory for Reinforcement Learning with Verifiable Rewards in Large Language Model Reasoning

تقترح هذه الورقة نظرية الميزانية النسبية للتعلم التعزيزي في استدلال النماذج اللغوية الكبيرة، حيث تُعرّف كمية رئيسية ξ\xi تحكم كفاءة العينات عبر الأنظمة الناقصة والمتوازنة والوفيرة، وتثبت تجريبياً أن الميزانية النسبية بين 1.5 و2.0 ترفع أداء التعلم إلى حده الأقصى.

Akifumi Wachi, Hirota Kinoshita, Shokichi Takakura, Rei Higuchi, Taiji Suzuki2026-02-03
💬 NLP

CoDiQ: Test-Time Scaling for Controllable Difficult Question Generation

تقدم هذه الورقة إطار عمل CoDiQ، الذي يستفيد من توسيع نطاق وقت الاختبار لتمكين التحكم الدقيق في صعوبة وقابلية حل الأسئلة المولدة بمستوى المسابقات، مما ينتج عنه مجموعة بيانات CoDiQ-Corpus التي تعزز بشكل كبير أداء نماذج الاستدلال الكبيرة عند استخدامها للتدريب.

Zhongyuan Peng, Caijun Xu, Changyi Xiao, Shibo Hong, Eli Zhang, Stephen Huang, Yixin Cao2026-02-03
💻 computer science

Prompting4Debugging: Red-Teaming Text-to-Image Diffusion Models by Finding Problematic Prompts

تقدم هذه الورقة أداة Prompting4Debugging (P4D)، وهي أداة اختبار اختراق مؤتمتة تكشف عن ثغرات أمنية جسيمة في آليات السلامة لنماذج الانتشار من نوع نص-إلى-صورة عبر إثبات أن العديد من المطالبات التي كانت تُعتبر سابقاً "آمنة" يمكن التلاعب بها لتجاوز الحمايات الحالية، مما يتحدى موثوقية معايير التقييم الحالية.

Zhi-Yi Chin, Chieh-Ming Jiang, Ching-Chun Huang, Pin-Yu Chen, Wei-Chen Chiu2026-01-15
💻 computer science

Word Synchronization Challenge: A Benchmark for Word Association Responses for Large Language Models

تقدم هذه الورقة "تحدي التزامن اللفظي"، وهو معيار مرجعي جديد يقيم قدرة النماذج اللغوية الكبيرة على محاكاة العمليات الإدراكية البشرية والتوافق مع أنماط الفكر البشري من خلال مهام الترابط اللفظي الديناميكي، مما يساهم في تطوير تعاون أكثر تعاطفاً ودقة بين الإنسان والآلة.

Tanguy Cazalets, Joni Dambre2026-01-15