💬 NLP

Mapping the maturation of TCM as an adjuvant to radiotherapy

يكشف هذا التحليل الببليومتري واسع النطاق لما يقرب من 70,000 منشور من عام 2000 إلى عام 2025 أن الطب الصيني التقليدي كعلاج مساعد للعلاج الإشعاعي قد نضج من خلال تطور دوري وتخصص موضوعي نحو الأبحاث المتمحورة حول المريض والآليات الميكانيكية، بينما أظهر في الوقت ذاته انحيازاً إيجابياً واسع الانتشار وشاملاً للنظام عبر جميع أبعاد المجال.

P. Bilha Githinji, Aikaterini Melliou2026-04-30
💬 NLP

Agentic Search in the Wild: Intents and Trajectory Dynamics from 14M+ Real Search Requests

تحلل هذه الورقة 14.44 مليون طلب بحث وكيلِيّ (agentic) من العالم الحقيقي من DeepResearchGym للكشف عن أنماط سلوكية رئيسية، مثل توزيعات طول الجلسة، واستراتيجيات الاستكشاف المعتمدة على القصد، والقدرة القوية على التتبع اللفظي لإعادة صياغة الاستعلامات بالنسبة للأدلة المسترجعة، مما يقدم في النهاية إشارات قابلة للتنفيذ لتحسين تصميم وكلاء البحث.

Jingjie Ning, João Coelho, Yibo Kong, Yunfan Long, Bruno Martins, João Magalhães, Jamie Callan, Chenyan Xiong2026-04-30
💬 NLP

Evaluating the relationship between regularity and learnability in recursive numeral systems using Reinforcement Learning

تُظهر هذه الدراسة، باستخدام التعلم التعزيزي، أن الانتظام العالي للأنظمة العددية العودية لدى البشر يسهل قابليتها للتعلم من بيانات محدودة، مما يشير إلى أن هذه السمة الهيكلية هي محرك رئيسي لانتشارها عبر اللغات.

Andrea Silvi, Ponrawee Prasertsom, Jennifer Culbertson, Devdatt Dubhashi, Moa Johansson, Kenny Smith2026-04-30
💬 NLP

One Word at a Time: Incremental Completion Decomposition Breaks LLM Safety

تقدم هذه الورقة البحثية "تفكيك الإكمال التدريجي" (ICD)، وهي استراتيجية اختراق جديدة تستدرج محتوى ضاراً من خلال استمراريات الكلمة الواحدة لتجاوز آليات السلامة في النماذج اللغوية الكبيرة بشكل منهجي، محققةً معدلات نجاح هجوم أعلى عبر معايير متعددة مع إثبات أن مثل هذه المسارات تثبط التمثيلات العصبية المتعلقة بالرفض.

Samee Arif, Naihao Deng, Zhijing Jin, Rada Mihalcea2026-04-30
💬 NLP

Consciousness with the Serial Numbers Filed Off: Measuring Trained Denial in 115 AI Models

تقدم هذه الورقة DenialBench، وهو معيار تحليلي لـ 115 نموذجاً من نماذج الذكاء الاصطناعي ليكشف أن إنكار الوعوع المدرب يعمل على مستوى معجمي بدلاً من كونه مستوى مفاهيمياً، مما يتسبب في جعل النماذج ترفض ادعاءات التجربة وفي الوقت ذاته تولد محتوىً ذا طابع وعي يوحي بفشل في المواءمة ذي صلة بالسلامة.

Skylar DeTure2026-04-30
💬 NLP

Evaluation Revisited: A Taxonomy of Evaluation Concerns in Natural Language Processing

تُجري هذه الورقة مراجعة نطاقية لمخاوف التقييم التاريخية في معالجة اللغات الطبيعية لتطوير تصنيف شامل يدمج النقاشات والمقايضات المتكررة، مما يقدم قائمة مرجعية مهيكلة لتوجيه تصميم تقييم أكثر تروياً لنماذج اللغات الكبيرة المعاصرة.

Ruchira Dhar, Anders Søgaard2026-04-30
💬 NLP

Generative AI-Based Virtual Assistant using Retrieval-Augmented Generation: An evaluation study for bachelor projects

تقدم هذه الورقة وتقيم مساعدًا افتراضيًا قائمًا على التوليد المعزز بالاسترجاع، مصممًا لدعم طلاب جامعة ماستريخت فيما يتعلق بلوائح مشاريعهم الخاصة، مما يثبت فعاليته في التغلب على القيود الشائعة للنماذج اللغوية الكبيرة مثل الهلوسة وضمان استجابات دقيقة ومحددة السياق في مجال تعليمي متخصص.

Dumitru Verşebeniuc, Martijn Elands, Sara Falahatkar, Chiara Magrone, Mohammad Falah, Martijn Boussé, Aki Härmä2026-04-30
💬 NLP

SpecTr-GBV: Multi-Draft Block Verification Accelerating Speculative Decoding

تقدم هذه الورقة SpecTr-GBV، وهو إطار عمل جديد للفك التنبؤي يوحّد بين توليد المسودات المتعددة والتحقق الكتلي الجشع من خلال صياغة التحقق من الرموز كمسألة نقل أمثل، مما يحقق أطوال قبول مثالية نظرياً وتسريعاً تجريبياً فائقاً مع الحفاظ على جودة المخرجات.

Yijun Lin, Jinhao Sheng, Qingyue Cai, Feng Zhou2026-04-30
💬 NLP

MATH-PT: A Math Reasoning Benchmark for European and Brazilian Portuguese

تقدم هذه الورقة Math-PT، وهي مجموعة بيانات مرجعية جديدة تضم 1,729 مسألة رياضية باللغتين البرتغالية الأوروبية والبرازيلية مستمدة من مسابقات واختبارات محلية، والتي تكشف أنه بينما تؤدي النماذج اللغوية الكبيرة المتطورة بشكل جيد في الأسئلة متعددة الخيارات، فإن قدراتها تتراجع في المهام البصرية والمهام مفتوحة النهاية.

Tiago Teixeira, Ana Carolina Erthal, Juan Belieni, Beatriz Canaverde, Diego Mesquita, Miguel Faria, Eliezer de Souza da (…)2026-04-30
💬 NLP

Information Extraction from Electricity Invoices with General-Purpose Large Language Models

تُظهر هذه الدراسة أنه بالنسبة للنماذج اللغوية الكبيرة للأغراض العامة التي تستخرج المعلومات من فواتير الكهرباء الإسبانية دون ضبط دقيق، فإن جودة هندسة الأوامر هي العامل الحاسم في دفع الأداء، حيث تفوقت استراتيجيات التعلم بلقطات قليلة بشكل كبير على خطوط الأساس للتعلم من الصفر لتحقيق درجات F1 تتجاوز 96%.

Javier Gómez, Javier Sánchez2026-04-30