🤖 AI

Tailoring the Curriculum: Student-Centered Reasoning Distillation via Dynamic Data-Model Compatibility

تقدم هذه الورقة مقياس توافق البيانات مع النموذج (DMC) لتقييم واختيار بيانات التدريب ديناميكيًا بناءً على مواءمتها مع قدرات نموذج الطالب، مما يعزز بشكل كبير أداء تقطير الاستنتاج عبر مختلف النماذج والمهام.

Jiahao Huang, Fei Cheng, Junfeng Jiang, Akiko Aizawa2026-05-29
🤖 machine learning

BlockBatch: Multi-Scale Consensus Decoding for Efficient Diffusion Language Model Inference

يُعد BlockBatch إطار عمل للاستنتاج خالٍ من التدريب يعمل على تسريع نماذج اللغة الانتشارية عبر تنفيذ فروع متعددة ذات حجم كتلي بالتوازي ودمجها من خلال المزامنة المعتمدة على الثقة، مما يقلل خطوات إزالة الضجيج ويحسن السرعة النهائية دون التضحية بالدقة.

Xiaoyou Wu (Celine), Cheng-Jhih Shih (Celine), Binfei Ji (Celine), Yong Liu (Celine), Yingyan (Celine), Lin2026-05-29
🤖 AI

Rethinking Literature Search Evaluation: Deep Research Helps, and Human Citation Lists Are Not a Ground Truth

تُثبت هذه الورقة أن مسار البحث العميق (Deep Research) يُحسّن بشكل كبير من استدعاء البحث في الأدبيات، بينما يكشف في الوقت ذاته أن قوائم الاستشهادات البشرية منحازة نحو المتعاونين وبالتالي فهي غير كافية كمرجع حقيقي وحيد، مما يدعو إلى إطار تقييم متعدد الأبعاد يجمع بين الاستدعاء، والملاءمة، والتنوع، والمسافة في التأليف المشترك.

Gaurav Sahu, Laurent Charlin, Christopher Pal2026-05-29
🤖 AI

Surfacing Isolated Learners with Outcome-Independent Mediation of Feedback between Teachers and Students Using AI

تقترح هذه الورقة طبقة قرار مدفوعة بالذكاء الاصطناعي وقابلة للتفسير، تعمل على تحديد المتعلمين المنعزلين وتحديد أولويات مواضيع المساق من خلال دمج التقارير الذاتية للطلاب، والصعوبات الملحوظة، ومخاوف المعلمين دون الاعتماد على النتائج الدرجية، مما يثبت فعاليتها في التوافق مع رؤى المحاضرين وكشف الطلاب المعرضين للخطر في مساق دراسات عليا في علوم الحاسوب.

Junsoo Park, Youssef Medhat, Htet Phyo Wai, Ploy Thajchayapong, Ashok K. Goel2026-05-29
💻 computer science

Wait! There's a Way Out: A Decision Mechanism for Forecasting Conversational Derailment

تقترح هذه الورقة آلية قرار مبتكرة للتنبؤ بانحراف المحادثة تعمل على فصل إطلاق التنبيه عن تقدير الاحتمالية عبر استخدام عمليات محاكاة استشرافية لتأجيل التنبيهات عندما يكون التعافي محتملاً، مما يقلل بشكل كبير من الإيجابيات الكاذبة دون التضحية بالدقة.

Laerdon Kim, Vivian Nguyen, Cristian Danescu-Niculescu-Mizil2026-05-29
🤖 AI

Provably Secure Agent Guardrail

تقترح هذه الورقة نموذجاً أمنياً جديداً لوكلاء الذكاء الاصطناعي يسمى إطار العمل "الإجراء المقيد بالبرهان القابل للتنفيذ" (ePCA)، والذي يستخدم بنية عزل عصبية رمزية لإجبار الوكلاء على صياغة نواياهم في شكل قيود منطقية من الدرجة الأولى قبل التنفيذ، مما يحقق دفاعاً حتمياً وآمناً بشكل مثبت ضد الهجمات الدلالية مع معدلات صفرية لنجاح الهجوم والإنذارات الكاذبة.

Benlong Wu, Weiming Zhang, Kejiang Chen, Han Fang, Nenghai Yu2026-05-29
🤖 machine learning

KLAS: Using Similarity to Stitch Neural Networks for Improved Accuracy-Efficiency Tradeoffs

تقدم الورقة البحثية KLAS، وهو إطار عمل مبتكر يعمل على أتمتة وتحسين عملية دمج الشبكات العصبية سابقة التدريب من خلال الاستفادة من تباعد كولباك - ليبلر لتحديد التمثيلات الوسيطة الأكثر تشابهاً، مما يؤدي إلى تحسين مقايضات الدقة والكفاءة بشكل كبير مقارنة بالنهج القائمة على الاستدلالات المتبعة حالياً.

Debopam Sanyal, Anantharaman Iyer, Alind Khare, Trisha Jain, Akshay Jajoo, Myungjin Lee, Clayton Kerce, Alexey Tumanov2026-05-29
🤖 AI

Harmonizing Real-Time Constraints and Long-Horizon Reasoning: An Asynchronous Agentic Framework for Dynamic Scheduling

يُعد RACE-Sched إطار عمل قائمًا على الوكلاء غير المتزامنين، وهو يحل الصراع بين القيود الزمنية الحقيقية والاستدلال طويل الأمد في جدولة ورش العمل الديناميكية من خلال فصل الاستدلالات الرمزية منخفضة زمن الاستجابة للتعيين الفوري عن التداول الموازي المدفوع بالنماذج اللغوية الكبيرة الذي يعمل على توليف وتطوير هذه القواعد بأمان.

Shijie Cao, Yuan Yuan, Jing Liu2026-05-29
🤖 AI

When and How Human Curation Backfires: Preference Alignment under Multi-Model Self-Consuming Loop

تكشف هذه الورقة أنه في حين أن التقييم البشري يحسن المحاذاة في النماذج ذاتية الاستهلاك المنعزلة، فإن توسيع هذا النموذج ليشمل أنظمة متعددة النماذج يمكن أن يؤدي إلى خبو أو انعكاس آثار التقييم من خلال التفاعلات بين النماذج، مما يؤدي في النهاية إلى تدهور المحاذاة على المدى الطويل.

Yang Zhang, Xiukun Wei, Xueru Zhang2026-05-29
💻 computer science

Compute Allocation in Evolutionary Search: From Depth-Breadth to Multi-Armed Bandits

تحلل هذه الورقة الانتظامات التجريبية للبحث التطوري الموجه بنماذج اللغات الكبيرة لاقتراح BaSE، وهو خوارزمية "المتعدد الأذرع" (multi-armed bandit) التي تخصص الحوسبة ديناميكيًا عبر مسارات متوازية، محققةً تحسنًا بنسبة 12.3% في متوسط اللياقة وتعزيزًا للموثوقية مقارنة باستراتيجيات العمق والاتساع التقليدية دون تعديل النموذج الأساسي أو المطالبات.

Sixue Xing, Haoyu He, Kerui Wu, Zhuo Yang, Haozheng Luo, Tianfan Fu, Aarthy Nagarajan2026-05-29