💬 NLP

LLM attribution analysis across different fine-tuning strategies and model scales for automated code compliance

تستخدم هذه الورقة تحليل العزو القائم على الاضطراب للكشف عن أن الضبط الدقيق الكامل يُنتج سلوكيات تفسيرية أكثر تركيزاً من الأساليب الفعالة في كفاءة المعلمات، بينما يؤدي زيادة حجم النموذج إلى تعزيز الانتباه لضوابط قواعد محددة رغم استقرار مكاسب الأداء بعد تجاوز 7 مليارات معلمة، مما يعزز قابلية التفسير للنماذج اللغوية الكبيرة لأتمتة الامتثال للأكواد في صناعة الهندسة والعمارة والإنشاءات.

Jack Wei Lun Shi, Minghao Dang, Wawan Solihin, Justin K. W. Yeoh2026-04-20
💬 NLP

Imperfectly Cooperative Human-AI Interactions: Comparing the Impacts of Human and AI Attributes in Simulated and User Studies

تقارن هذه الدراسة بين التجارب المحاكية وتجارب الخاضعين للتجارب البشرية لتكشف أنه بينما تتساوى سمات الذكاء الاصطناعي وسمات الشخصية البشرية في التأثير ضمن المحاكاة، فإن التفاعلات الفعلية بين البشر والذكاء الاصطناعي في سيناريوهات التعاون غير المثالية مدفوعة أساساً بخصائص تصميم الذكاء الاصطناعي، ولا سيما الشفافية، مما يسلط الض الضوء على تباينات جوهرية بين النماذج المحاكية والسلوك البشري في العالم الحقيقي.

Myke C. Cohen, Mingqian Zheng, Neel Bhandari, Hsien-Te Kao, Xuhui Zhou, Daniel Nguyen, Laura Cassani, Maarten Sap, Svitl (…)2026-04-20
💬 NLP

Rethinking the Necessity of Adaptive Retrieval-Augmented Generation through the Lens of Adaptive Listwise Ranking

تقدم هذه الورقة البحثية AdaRankLLM، وهو إطار عمل استرجاع تكيفي يستخدم الترتيب القائم على القوائم والتقطير التدريجي لإثبات أن الاسترجاع التكيفي يعمل كمرشح ضوضاء حاسم للنماذج الأضعف ومحسن كفاءة منخفض التكلفة للنماذج الأقوى، وغالباً ما يتفوق على استراتيجيات الاسترجاع الثابتة مع تقليل عبء السياق.

Jun Feng, Jiahui Tang, Zhicheng He, Hang Lv, Hongchao Gu, Hao Wang, Xuezhi Yang, Shuai Fang2026-04-20
💬 NLP

FD-NL2SQL: Feedback-Driven Clinical NL2SQL that Improves with Use

إنّ FD-NL2SQL هو مساعد سريري لترجمة اللغة الطبيعية إلى لغة الاستعلام الهيكلية (NL2SQL) يعتمد على التغذية الراجعة لقواعد بيانات أورام السرطان، حيث يقوم بتفكيك استعلامات اللغة الطبيعية إلى أسئلة فرعية، واسترجاع نماذج خبير، وتوليد استعلامات SQL قابلة للتنفيذ مع تحسين أدائه باستمرار من خلال تعديلات الأطباء والتعزيز الآلي لمنطق لغة SQL.

Suparno Roy Chowdhury, Tejas Anvekar, Manan Roy Choudhury, Muhammad Ali Khan, Kaneez Zahra Rubab Khakwani, Mohamad Bassa (…)2026-04-20
💬 NLP

CIG: Measuring Conversational Information Gain in Deliberative Dialogues with Semantic Memory Dynamics

تقدم هذه الورقة إطار عمل لـ "كسب المعلومات الحواري" (CIG) يقيم جودة الحوار التداولي من خلال نمذجة ذاكرة دلالية متطورة للادعاءات الذرية لتسجيل العبارات بناءً على الجدة، والصلة، ونطاق الاستلزام، مما يثبت أن هذه الديناميكيات المستمدة من الذاكرة ترتبط بقوة أكبر بالتقدم المعلوماتي المدرك بشرياً مقارنة بالاستدلالات التقليدية.

Ming-Bin Chen, Jey Han Lau, Lea Frermann2026-04-20
🤖 machine learning

Faster LLM Inference via Sequential Monte Carlo

تقدم هذه الورقة البحثية "فك التشفير الاستباقي عبر مونت كارلو المتسلسل" (SMC-SD)، وهي طريقة استدلال مبتكرة تستبدل الرفض على مستوى الرمز بإعادة أخذ العينات الموزونة بالأهمية عبر جزيئات المسودة لتحقيق تسريع كبير (يصل إلى 5.2 ضعفًا مقارنة بفك التشفير ذاتي الانحدار) مع الحفاظ على دقة عالية من خلال استغلال الحوسبة الخاملة للتحقق المتجهي.

Yahya Emara, Mauricio Barba da Costa, Chi-Chih Chang, Cameron Freer, Tim Vieira, Ryan Cotterell, Mohamed S. Abdelfattah2026-04-20
💬 NLP

Preference Estimation via Opponent Modeling in Multi-Agent Negotiation

تقترح هذه الورقة إطار عمل مبتكر يدمج النماذج اللغوية الكبيرة مع نمذجة الخصم البايزية المهيكلة لتحويل الإشارات النوعية للغة الطبيعية إلى معتقدات احتمالية، مما يعزز دقة تقدير التفضيلات ومعدلات الاتفاق في المفاوضات المعقدة متعددة الوكلاء.

Yuta Konishi, Kento Yamamoto, Eisuke Sonomoto, Rikuho Takeda, Ryo Furukawa, Yusuke Muraki, Takafumi Shimizu, Kazuma Fuku (…)2026-04-20
💬 NLP

The Metacognitive Monitoring Battery: A Cross-Domain Benchmark for LLM Self-Monitoring

تقدم هذه الورقة "بطارية مراقبة ما وراء المعرفة" (Metacognitive Monitoring Battery)، وهي معيار مرجعي متعدد المجالات يرتكز على إطار نيلسون ونارنز لتقييم 20 نموذجاً من النماذج اللغوية الكبيرة الرائدة باستخدام أساليب القياس النفسي البشري للكشف عن ملفات تعريف متميزة للمراقبة الذاتية، وانفصال بين الدقة والحساسية، وأنماط توسع تعتمد على البنية الهيكلية.

Jon-Paul Cacioli2026-04-20
💬 NLP

Target-Oriented Pretraining Data Selection via Neuron-Activated Graph

تقدم هذه الورقة البحثية "ترتيب الرسوم البيانية المنشط عصبياً" (NAG-based Ranking)، وهو إطار عمل يعتمد على التفسير ولا يتطلب تدريباً، يقوم باختيار بيانات ما قبل التدريب من خلال تحديد وترتيب العينات بناءً على تشابهها مع الأمثلة المستهدفة عبر رسم بياني متفرق من العصبونات عالية التأثير، مما يحسن بشكل كبير أداء النماذج اللغوية الموجهة نحو الأهداف عبر العديد من المعايير المرجعية.

Zijun Wang, Haoqin Tu, Weidong Zhou, Yiyang Zhou, Xiaohuan Zhou, Bingni Zhang, Weiguo Feng, Taifeng Wang, Cihang Xie, Fe (…)2026-04-20
💬 NLP

RefereeBench: Are Video MLLMs Ready to be Multi-Sport Referees

تقدم هذه الورقة البحثية RefereeBench، وهو أول معيار واسع النطاق يضم 11 رياضة وأكثر من 6,000 زوج من الأسئلة والأجوبة لتقييم نماذج اللغات الكبيرة متعددة الوسائط (MLLMs) كحكام رياضيين، مما يكشف أن حتى النماذج الأكثر تطوراً تعاني في تطبيق القواعد والتأصيل الزمني، حيث حققت دقة تبلغ حوالي 60% فقط، مما يسلط الض�وء على الفجوة الكبيرة بين القدرات الحالية والتحكيم الآلي الموثوق.

Yichen Xu, Yuanhang Liu, Chuhan Wang, Zihan Zhao, jinghan luo, Jianzhe Ma, Wenxuan Wang, Qin Jin2026-04-20