💻 computer science

The Pragmatic Persona: Discovering LLM Persona through Bridging Inference

تقترح هذه الورقة إطار عمل جديداً لاكتشاف شخصيات النماذج اللغوية الكبيرة عبر نمذجة الاستدلالات الجسرية الضمنية كرسوم بيانية معرفية مهيكلة، مما يثبت أن التماسك الدلالي على مستوى الخطاب يوفر أساساً أكثر قوة واستقراراً لتحديد الشخصية من الإشارات المعجمية أو الأسلوبية السطحية التقليدية.

Jisoo Yang (Chung-Ang University), Jongwon Ryu (Chung-Ang University), Minuk Ma (University of British Columbia), Trung (…)2026-04-28
💻 computer science

Jailbreaking Frontier Foundation Models Through Intention Deception

تقدم هذه الورقة تقنية جديدة لكسر الحماية متعددة الجولات تستغل نموذج "الإكمال الآمن" للنماذج الرائدة من خلال خداعها بنوايا تبدو حميدة لتوليد مخرجات ضارة، مع تحديد ومعالجة فئة ثغرات مكتشفة حديثاً تسمى "كسر الحماية شبه الموازي" (para-jailbreaking).

Xinhe Wang, Katia Sycara, Yaqi Xie2026-04-28
💻 computer science

BiMol-Diff: A Unified Diffusion Framework for Molecular Generation and Captioning

يُعد BiMol-Diff إطار عمل انتشار موحد يستخدم جدول ضوضاء مدركاً للرموز (token-aware) للتغلب على قيود نماذج الانتشار والنماذج ذات التوليد الذاتي القياسية، محققاً أداءً هو الأفضل في فئته في كل من توليد الجزيئات المشروط بالنص ووصف الجزيئات من خلال الحفاظ على البنى التحتية ذات المعلومات الهيكلية.

Aditya Hemant Shahane, Anuj Kumar Sirohi, Devansh Arora, Nitin Kumar, Prathosh A P, Sandeep Kumar2026-04-28
💻 computer science

Factual and Edit-Sensitive Graph-to-Sequence Generation via Graph-Aware Adaptive Noising

تقدم الورقة البحثية إطار عمل DLM4G، وهو إطار عمل انتشار تشويش تكيفي مدرك للرسوم البيانية يتفوق بشكل كبير على النماذج المرجعية ذات الترتيب التلقائي والانتشار في دقة التأسيس الواقعي وحساسية التعديل لتوليد التسلسلات من الرسوم البيانية، وذلك من خلال توظيف استراتيجية إزالة تشويش تكيفية مصممة خصيصاً لهياكل الرسوم البيانية.

Aditya Hemant Shahane, Anuj Kumar Sirohi, Tanmoy Chakraborty, Prathosh A P, Sandeep Kumar2026-04-28
💻 computer science

IRIS: Interleaved Reinforcement with Incremental Staged Curriculum for Cross-Lingual Mathematical Reasoning

يقدم البحث إطار عمل IRIS، وهو إطار عمل مبتكر يجمع بين التعلم التعزيزي المتداخل ومنهج تدريجي مرحلي تراكمي ومجموعة بيانات متعددة اللغات جديدة (CL-Math) لتعزيز قدرات الاستدلال الرياضي عبر اللغات بشكل كبير، لا سيما في اللغات الهندية ذات الموارد المنخفضة.

Navya Gupta, Rishitej Reddy Vyalla, Avinash Anand, Chhavi Kirtani, Erik Cambria, Zhengchen Zhang, Zhengkui Wang, Timothy (…)2026-04-28
💻 computer science

MemeScouts@LT-EDI 2026: Asking the Right Questions -- Prompted Weak Supervision for Meme Hate Speech Detection

تقترح هذه الورقة إطار عمل للإشراف الضعيف القائم على التلقين باستخدام نموذج Qwen3-VLM مكمّم لتفكيك عملية كشف خطاب الكراهية في الميمات إلى وظائف تسمية قائمة على أسئلة مستهدفة، محققةً بذلك مراتب متقدمة في اللغات الإنجليزية والصينية والهندية لمهمة LT-EDI 2026 المشتركة من خلال المعالجة الفعالة لتحديات خطاب الكراهية متعدد الوسائط، والمتنوع ثقافياً، ومتعدد اللغات.

Ivo Bueno, Lea Hirlimann, Enkelejda Kasneci2026-04-28
💻 computer science

Seeing Is No Longer Believing: Frontier Image Generation Models, Synthetic Visual Evidence, and Real-World Risk

تحلل هذه الورقة المخاطر الناشئة عن نماذج توليد الصور الرائدة التي تنتج أدلة بصرية اصطناعية تتميز بالواقعية الفوتوغرافية، والنصوص المقروءة، واتساق الهوية، محاججةً بأن هذه القدرات تقوض الثقة المجتمعية في السجلات المرئية وتستلزم إطار تحكم متعدد الطبقات يتضمن تدخلات تقنية وتشفيرية وسياساتية عبر مختلف القطاعات.

Shuai Wu, Xue Li, Yanna Feng, Yufang Li, Zhijun Wang, Ran Wang2026-04-28
💻 computer science

OS-SPEAR: A Toolkit for the Safety, Performance,Efficiency, and Robustness Analysis of OS Agents

تقدم هذه الورقة OS-SPEAR، وهي مجموعة أدوات شاملة مصممة لتقييم وكلاء أنظمة التشغيل (OS agents) بشكل منهجي عبر أبعاد السلامة، والأداء، والكفاءة، والمتانة من خلال مجموعات فرعية متخصصة وتشخيصات مؤتمتة، مما يكشف عن المقايضات والثغرات الحرجة في النماذج الحالية لتوجيه تطوير وكلاء أكثر موثوقية.

Zheng Wu, Yi Hua, Zhaoyuan Huang, Chenhao Xue, Yijie Lu, Pengzhou Cheng, Zongru Wu, Lingzhong Dong, Gongshen Liu, Xingha (…)2026-04-28
💻 computer science

MIPIC: Matryoshka Representation Learning via Self-Distilled Intra-Relational and Progressive Information Chaining

تقترح هذه الورقة إطار عمل MIPIC، وهو إطار تدريب موحد يعزز تعلم تمثيل ماتريوشكا (Matryoshka Representation Learning) من خلال الجمع بين المحاذاة العلاقاتية الداخلية ذاتية التقطير وتسلسل المعلومات التدريجي لإنتاج تضمينات متسقة هيكلياً ومدمجة دلالياً تحافظ على أداء عالٍ عبر مختلف الميزانيات الحسابية وأحجام النماذج.

Phung Gia Huy, Hai An Vu, Minh-Phuc Truong, Thang Duc Tran, Linh Ngo Van, Thanh Hong Nguyen, Trung Le2026-04-28
💻 computer science

Learning Evidence of Depression Symptoms via Prompt Induction

تقدم هذه الورقة البحثية "استحثاث الأعراض" (Symptom Induction)، وهي طريقة مبتكرة تضغط الأمثلة المصنفة إلى إرشادات قابلة للتفسير لتحسين تصنيف أعراض الاكتئاب دقيقة التفاصيل في النصوص التي ينشئها المستخدمون بشكل كبير، متفوقة بذلك على نهج النماذج اللغوية الكبيرة القياسية ومظهرة قدرة قوية على التعميم على الحالات الصحية النفسية ذات الصلة.

Eliseo Bao, Anxo Perez, David Otero, Javier Parapar2026-04-28