💬 NLP

To Lie or Not to Lie? Investigating The Biased Spread of Global Lies by LLMs

تقدم هذه الورقة GlobalLies، وهي مجموعة بيانات متعددة اللغات تكشف أن النماذج اللغوية الكبيرة تولد وتنشر المعلومات المضللة بشكل غير متناسب عن اللغات ذات الموارد المنخفضة والدول ذات درجات مؤشر التنمية البشرية المنخفضة، مع تسليط الضوء على فجوات كبيرة في استراتيجيات التخفيف الحالية عبر مختلف المناطق واللغات.

Zohaib Khan, Mustafa Dogan, Ifeoma Okoh, Pouya Sadeghi, Siddhartha Shrestha, Sergius Justus Nyah, Mahmoud O. Mokhiamar (…)2026-04-09
💬 NLP

The Detection--Extraction Gap: Models Know the Answer Before They Can Say It

تحدد هذه الورقة "فجوة الكشف والاستخراج" في نماذج الاستدلال الحديثة حيث تصبح الإجابة الصحيحة قابلة للاسترداد من الحالة الداخلية قبل وقت طويل من توليدها صراحةً، وتقترح طريقة "الخروج المبكر التكيفي للصندوق الأسود" التي تستفيد من هذا التباين لتقليل تكاليف التوليد بشكل كبير مع تحسين الدقة.

Hanyang Wang, Mingxuan Zhu2026-04-09
💬 NLP

Argus: Reorchestrating Static Analysis via a Multi-Agent Ensemble for Full-Chain Security Vulnerability Detection

تقدم الورقة البحثية "Argus"، وهو إطار عمل جديد متعدد الوكلاء يعيد تنظيم سير عمل التحليل الساكن من خلال دمج تحليل سلاسل التوريد، والوكلاء المتعاونين، وتقنيات متقدمة مثل RAG وReAct ليتفوق بشكل كبير على الأساليب الحالية القائمة على النماذج اللغوية الكبيرة في اكتشاف الثغرات الحقيقية مع تقليل الإيجابيات الكاذبة والتكاليف التشغيلية.

Zi Liang, Qipeng Xie, Jun He, Bohuan Xue, Weizheng Wang, Yuandao Cai, Fei Luo, Boxian Zhang, Haibo Hu, Kaishun Wu2026-04-09
💬 NLP

Feedback Adaptation for Retrieval-Augmented Generation

تقدم هذه الورقة البحثية "التكيف مع التغذية الراجعة" كبُعد تقييمي حاسم لأنظمة التوليد المعزز بالاسترجاع، مقترحةً مقاييس مثل "تأخر التصحيح" و"الأداء ما بعد التغذية الراجعة" للكشف عن قصور التقييمات الثابتة، ومبرهنةً على أن طريقة الاستدلال المقترحة، PatchRAG، تحقق تصحيحاً فورياً وتعمماً قوياً دون الحاجة لإعادة التدريب.

Jihwan Bang, Seunghan Yang, Kyuhong Shim, Simyung Chang, Juntae Lee, Sungha Choi2026-04-09
💬 NLP

A Parameter-Efficient Transfer Learning Approach through Multitask Prompt Distillation and Decomposition for Clinical NLP

تقدم هذه الورقة إطار عمل لتعلم نقل المعرفة كفء في المعلمات، يقوم بتقطير "مطالبة عليا" (metaprompt) مشتركة واحدة من 21 مهمة سريرية متنوعة، مما يتيح التكيف مع مهام معالجة اللغات الطبيعية السريرية الجديدة باستخدام أقل من 0.05% من المعلمات القابلة للتدريب، مع التفوق على كل من تقنية LoRA وضبط المطالبة أحادي المهمة عبر نماذج هيكلية وأنواع مهام متعددة.

Cheng Peng, Mengxian Lyu, Ziyi Chen, Yonghui Wu2026-04-09
💬 NLP

Between Century and Poet: Graph-Based Lexical Semantic Change in Persian Poetry

تتقصى هذه الورقة التغير الدلالي المعجمي في الشعر الفارسي من خلال نمذجته كعملية إعادة صياغة للروابط في الرسوم البيانية الدلالية المحلية ضمن فضاءات (Word2Vec) المتوافقة عبر القرون والشعراء، مما يكشف أن التحولات الهيكلية في الجوار تلتقط المعنى التاريخي والعلائقي بشكل أفضل من مجرد الإزاحة المتجهة البسيطة.

Kourosh Shahnazari, Seyed Moein Ayyoubzadeh, Mohammadali Keshtparvar2026-04-09
💬 NLP

ChemVLR: Prioritizing Reasoning in Perception for Chemical Vision-Language Understanding

يُعد ChemVLR نموذجاً جديداً للرؤية واللغة الكيميائية يعطي الأولوية للاستدلال دقيق التفاصيل من خلال تحديد الواصفات الكيميائية صراحةً قبل الإجابة، مستفيداً من مجموعة بيانات منسقة واسعة النطاق وإطار تدريب ثلاثي المراحل لتحقيق أداء رائد في الفهم البصري الكيميائي القابل للتفسير.

Xuanle Zhao, Xinyuan Cai, Xiang Cheng, Xiuyi Chen, Bo Xu2026-04-09
💬 NLP

Specializing Large Models for Oracle Bone Script Interpretation via Component-Grounded Multimodal Knowledge Augmentation

تقترح هذه الورقة إطار عمل لنموذج رؤية-لغة مدفوع بالوكيل، معزز بمجموعة بيانات جديدة مشروحة من قبل الخبراء تسمى OB-Radix، لسد فجوة التفسير في فك رموز الكتابة على العظام الأوركيلية من خلال الاستفادة من المعاني الدلالية القابلة للنقل للمكونات التصويرية المتكررة لتحقيق نتائج أكثر دقة ودقة لغوية.

Jianing Zhang, Runan Li, Honglin Pang, Ding Xia, Zhou Zhu, Qian Zhang, Chuntao Li, Xi Yang2026-04-09
💬 NLP

Luwen Technical Report

تقدم هذه الورقة البحثية "لووين" (Luwen)، وهو نموذج لغوي صيني مفتوح المصدر مبني على أساس "بايتشان" (Baichuan)، والذي يستفيد من التدريب المسبق المستمر، والضبط الدقيق الخاضع للإشراف، وتوليد التعزيز بالاسترجاع للتفوق على النماذج المرجعية الحالية عبر خمس مهام قانونية رئيسية.

Yiquan Wu, Yuhang Liu, Yifei Liu, Ang Li, Siying Zhou, Kun Kuang2026-04-09
💬 NLP

StructKV: Preserving the Structural Skeleton for Scalable Long-Context Inference

يُعد StructKV إطار عمل مبتكر لضغط ذاكرة التخزين المؤقت (KV cache) يتغلب على قيود الطرق القائمة على البروز المحلي من خلال إدخال المركزية العالمية لدرجة الدخول، والكشف الديناميكي عن المحاور، والانتشار الهيكلي للحفاظ على التبعيات طويلة المدى وتحسين كفاءة الذاكرة من أجل استدلال نماذج اللغات الكبيرة ذات السياق الطويل والقابلة للتوسع.

Zhirui Chen, Peiyang Liu, Ling Shao2026-04-09