💬 NLP

PEML: Parameter-efficient Multi-Task Learning with Optimized Continuous Prompts

تقترح الورقة البحثية إطار عمل PEML، وهو إطار تعلم متعدد المهام كفء من حيث المعلمات يجمع بين هندسة البنية العصبية لتحسين المطالبات المستمرة وبين التكيف منخفض الرتبة لأوزان النموذج، محققاً تحسينات كبيرة في الدقة مقارنة بأحدث الأساليب عبر عدة معايسات قياسية.

Anjir Ahmed Chowdhury, Syed Zawad, Xiaolong Ma, Xu Dong, Feng Yan2026-05-15
💻 computer science

MathAtlas: A Benchmark for Autoformalization in the Wild

تقدم هذه الورقة MathAtlas، وهو أول معيار للتحويل التلقائي إلى صيغ رياضية (autoformalization) واسع النطاق يضم ما يقرب من 52,000 مفهوم رياضي بمستوى الدراسات العليا من 103 كتب مدرسية، مما يكشف عن الصعوبة البالغة التي تواجهها النماذج الحالية في التعامل مع الرياضيات البحثية المعقدة والغنية بالارتباطات.

Nilay Patel, Noah Arias, Davit Babayan, Victoria Cochran, Timothy Libman, Hafsah Mahmood, Liam McCarty, Soli Munoz, Laur (…)2026-05-15
💬 NLP

Know When To Fold 'Em: Token-Efficient LLM Synthetic Data Generation via Multi-Stage In-Flight Rejection

تقدم الورقة البحثية إطار عمل "الرفض متعدد المراحل أثناء الطيران" (MSIFR)، وهو إطار عمل لا يتطلب تدريباً يقلل بشكل كبير من استهلاك الرموز (tokens) في توليد البيانات الاصطناعية القائمة على النماذج اللغوية الكبيرة (LLMs) عن طريق اكتشاف وإنهاء المخرجات منخفضة الجودة في مراحل وسيطة دون المساس بجودة أو تحيز العينات المحتفظ بها.

Anjir Ahmed Chowdhury, Syed Zawad, Feng Yan2026-05-15
💬 NLP

CRANE: Constrained Reasoning Injection for Code Agents via Nullspace Editing

تُعد CRANE طريقةً لتعديل المعلمات دون الحاجة إلى تدريب، حيث تدمج نقاط تفتيش وكلاء الأكواد من نوعي Instruct وThinking عبر تعديل الفضاء الصفري (nullspace editing) لتعزيز أداء الاستدلال طويل المدى واستخدام الأدوات بشكل كبير مع الحفاظ على الكفاءة.

Mingzhi Zhu, Michele Merler, Raju Pavuluri, Stacy Patterson2026-05-15
💻 computer science

SkillFlow: Flow-Driven Recursive Skill Evolution for Agentic Orchestration

تُعد SkillFlow إطار عمل قائم على التدفق يوظف موازنة المسار المبردة لتمكين وكيل مشرف قابل للتدريب من أتمتة تنسيق المهام باستراتيجيات متنوعة وتخصيص ائتماني شفاف، مع استخدام آلية تكرارية لتطوير مكتبة مهاراته ذاتياً لتحسين الأداء عبر مختلف المهام المعقدة.

Mingda Zhang, Tiesunlong Shen, Haoran Luo, Wenjin Liu, Zikai Xiao, Erik Cambria, Xiaoying Tang2026-05-15
💻 computer science

Bridging the Rural Healthcare Gap: A Cascaded Edge-Cloud Architecture for Automated Retinal Screening

تقترح هذه الورقة بنية متتالية من طبقتين (حافة-سحابة) تستخدم نموذج MobileNetV3-small خفيف الوزن للفرز المحلي ونموذج RETFound-DINOv2 قوي لتصنيف الشدة القائم على السحابة، مما نجح في تقليل استخدام السحابة بنسبة 50% تقريبًا لفحص اعتلال الشبكية السكري في المناطق الريفية مع الحفاظ على دقة تشخيصية مماثلة لخط الأساس المعتمد على السحابة فقط.

Nishi Doshi, Shrey Shah2026-05-15
💻 computer science

Modeling Bounded Rationality in Drug Shortage Pharmacists Using Attention-Guided Dynamic Decomposition

تقترح هذه الورقة وتتحقق من صحة إطار عمل تفكيك ديناميكي موجه بالانتباه ينمذج العقلانية المحدودة لدى صيادلة المستشفيات عبر منح الأولوية للجهد المعرفي لنقص الأدوية الحرج، مما يثبت أن استراتيجيات الإرضاء هذه تتيح اتخاذ قرارات مستقرة في ظل عدم اليقين دون الحاجة إلى الاستنتاج الكامل للحالة.

Yaniv Eliyahu Amiri, Noah Chicoine, Jacqueline Griffin, Stacy Marsella2026-05-15
💻 computer science

ProtoMedAgent: Multimodal Clinical Interpretability via Privacy-Aware Agentic Workflows

يُعد ProtoMedAgent إطار عمل متعدد الوسائط ومراعٍ للخصوصية، يعمل على تعزيز التفسير السريري والتوثيق من خلال استبدال طرق استرجاع المعلومات المعزز (RAG) المعرضة للأخطاء بسير عمل وكيل عصبي-رمزي، يفرض قيوداً رياضية على توليد النماذج اللغوية الكبيرة لمنع الهلوسة مع ضمان مجهولية البيانات من خلال معايير kk-anonymity و \ell-diversity.

Alvaro Lopez Pellicer, Plamen Angelov, Marwan Bukhari, Yi Li, Eduardo Soares, Jemma Kerns2026-05-15
💻 computer science

ClawForge: Generating Executable Interactive Benchmarks for Command-Line Agents

يقدم هذا البحث "ClawForge"، وهو إطار عمل تقييمي مدعوم بمولد، يقيم وكلاء سطر الأوامر في تدفقات عمل قابلة للتنفيذ مع وجود تعارضات في الحالة المستمرة، مما يكشف أن النماذج الرائدة الحالية تواجه صعوبة كبيرة في فحص الحالات القائمة والتعامل مع المصنوعات الموجودة مسبقاً، حيث حققت دقة صارمة لا تتجاوز 45.3%.

Yuxiang Lai, Peng Xia, Haonian Ji, Kaiwen Xiong, Kaide Zeng, Jiaqi Liu, Fang Wu, Jike Zhong, Zeyu Zheng, Cihang Xie, Hua (…)2026-05-15
💻 computer science

Distribution-Aware Algorithm Design with LLM Agents

تقدم هذه الورقة إطار عمل مدركاً للتوزيع حيث تستنتج وكلاء النماذج اللغوية الكبيرة (LLM agents) "تلميحات حل" قابلة لإعادة الاستخدام من عينات المهام لتجميع كود تنفيذي متخصص، مما يثبت أن هذه الحلول المُصنعة تحقق جودة حل تقترب من المثالية مع تفوق ملحوظ على الاستدلالات العامة والمحللات الدقيقة من حيث وقت التشغيل عبر مختلف مشكلات الأمثلة التوافقية.

Saharsh Koganti, Priyadarsi Mishra, Pierfrancesco Beneventano, Tomer Galanti2026-05-15