🤖 AI

Context Pruning for Coding Agents via Multi-Rubric Latent Reasoning

تقدم الورقة البحثية LaMR، وهو إطار عمل مهيكل لتقليم السياق يقوم بتفكيك صلة الكود البرمجي إلى أبعاد دلالية واعتمادية باستخدام استدلال كامن متعدد المعايير وإشراف قائم على أشجار الإسناد التركيبية (AST) لتقليل استخدام الرموز (tokens) بشكل كبير مع الحفاظ على أداء وكلاء البرمجة أو تحسينه.

Jingjing Wang, Xiwen Chen, Wenhui Zhu, Huayu Li, Zhengxiao He, Feiyang Cai, Ana S. Carreon-Rascon, Xuanzhao Dong, Feng L (…)2026-05-18
🤖 machine learning

From I/O to Code with Discovery Agent

تقدم هذه الورقة البحثية DIO-Agent، وهو إطار عمل للاكتشاف يحل مشكلة IO2Code الصعبة من خلال صياغة تخليق البرامج كعملية بحث تطوري موجهة بأخطاء التنفيذ و"فرضية أولوية التحويل" لإعطاء الأولوية للفرضيات البسيطة، مما يظهر أداءً فائقاً على منهجية IO2CodeBench المنشأة حديثاً مقارنة بالأساليب الحالية.

Yihong Dong, Jiaru Qian, Haoran Zhang, Peixu Wang, Binhua Li, Zhi Jin, Yongbin Li, Ge Li, Xiaokang Yang, Xue Jiang2026-05-18
💬 NLP

Automatic Construction of a Legal Citation Graph from 100 Million Ukrainian Court Decisions: Large-Scale Extraction, Topological Analysis, and Ontology-Driven Clustering

تقدم هذه الورقة البحثية البناء الآلي لمخطط استشهاد قانوني ضخم من أكثر من 100 مليون قرار قضائي أوكراني، كاشفةً أن التحليل غير الخاضع للإشراف لـ 502 مليون حافة استشهاد يرمز بفعالية حدود النطاق القانوني، ويتنبأ بالأهمية التشريعية بدقة تقارب الكمال، ويكتشف التغيرات في الأنظمة، مما يتيح إنشاء سير عمل مدفوع بالأنطولوجيا للتحليل القانوني بمساعدة النماذج اللغوية الكبيرة.

Volodymyr Ovcharov2026-05-18
💬 NLP

Capability Conditioned Scaffolding for Professional Human LLM Collaboration

تقدم هذه الورقة البحثية "السقالات المشروطة بالقدرة" (Capability Conditioned Scaffolding)، وهو إطار عمل يخفف من حدة الانحراف في المجال المهني في التعاون بين الإنسان والذكاء الاصطناعي من خلال تطويع تدخلات الذكاء الاصطناعي لتناسب مستويات خبرة المستخدمين المحددة عبر المجالات القوية، والمختلطة، والضعيفة.

Sen Yang, Yinglei Ma2026-05-18
💬 NLP

Why are language models less surprised than humans? Testing the Parse Multiplicity Mismatch Hypothesis

تختبر هذه الورقة الفرضية القائلة بأن تقليل النماذج اللغوية لتقدير صعوبة المعالجة البشرية في حالات الغموض التركيبي ينبع من قدرتها على الحفاظ على عدد أكبر من التحليلات الجملية المتزامنة مقارنة بالبشر، لكنها تجد أنه بينما يؤدي تقليل تعدد التحليلات إلى زيادة تأثيرات "طريق الحديقة" المتوقعة، إلا أنه يفشل في تفسير حجم الاختلافات في زمن القراءة البشري بشكل كامل.

William Timkey, Brian Dillon, Tal Linzen2026-05-18
💬 NLP

Reasoning Models Don't Just Think Longer, They Move Differently

تُثبت هذه الورقة أنه بعد التصحيح لطول عملية التوليد، تُظهر النماذج المدربة على الاستنتاج هندسات مسارات داخلية متميزة — لا سيما في مجالات البرمجة — تعكس تحولات استراتيجية حقيقية ومراقبة لعدم اليقين بدلاً من كونها مجرد عمليات حسابية ممتدة.

Anders Gjølbye, Lars Kai Hansen, Sanmi Koyejo2026-05-18
🤖 machine learning

GRLO: Towards Generalizable Reinforcement Learning in Open-Ended Environments from Zero

تقدم الورقة البحثية GRLO، وهو نهج تعلم تعزيزي عالي الكفاءة يدرب النماذج من الصفر على مجموعة صغيرة من التفاعلات الحوارية المفتوحة لتحقيق تعميم قوي عبر مجالات متنوعة مثل الرياضيات والبرمجة، مما يقلل بشكل كبير من متطلبات البيانات والحوسبة مقارنة بطرق RLVR التقليدية الخاصة بالمجال نفسه.

Shangjian Yin, Yu Fu, Yue Dong, Zhouxing Shi2026-05-18
💬 NLP

Retrieval-Augmented Large Language Models for Schema-Constrained Clinical Information Extraction

تقترح هذه الورقة مساراً نموذجياً للتوليد المعزز بالاسترجاع باستخدام GPT-5.2 والتلقين المقيد بالمخطط لاستخراج وتطبيع الملاحظات السريرية من نصوص المحادثات بين الممرض والمريض إلى تنسيق مهيكل، محققةً درجة F1 بنسبة 80.36% مع إثبات أن الاسترجاع المعزز والتدقيق في المرحلة الثانية يعززان بشكل كبير الالتزام بالمخطط.

A H M Rezaul Karim, Ozlem Uzuner2026-05-18
💬 NLP

FINESSE-Bench: A Hierarchical Benchmark Suite for Financial Domain Knowledge and Technical Analysis in Large Language Models

تقدم هذه الورقة FINESSE-Bench، وهي مجموعة معايير هرمية تضم 3,993 سؤالاً عبر ثماني مهام متخصصة — بما في ذلك امتحانات على نمط الشهادات، وتطبيقات التداول، وأولمبياد باللغة الروسية — لتقييم تطور المعرفة بالمجال المالي وقدرات الاستدلال التقني في النماذج اللغوية الكبيرة بشكل شامل.

Dmitry Stanishevskii, Nini Kamkia, Alexey Khoroshilov, Dmitry Zmitrovich, Denis Kokosinskii, Zhirayr Hayrapetyan, Andrei (…)2026-05-18
💬 NLP

Process Rewards with Learned Reliability

تقدم هذه الورقة البحثية BetaPRM، وهو نموذج مكافأة عمليات توزيعي يتنبأ بكل من احتمالات النجاح على مستوى الخطوة وموثوقيتها لتمكين تخصيص الحوسبة التكيفي، مما يحسن بشكل كبير مقايضة الدقة مقابل عدد الرموز (accuracy-token tradeoff) في استدلال "الأفضل من N" (Best-of-N) من خلال ضبط الحوسبة ديناميكيًا بناءً على ثقة التنبؤ.

Jinyuan Li, Langlin Huang, Chengsong Huang, Shaoyang Xu, Donghong Cai, Yuyi Yang, Wenxuan Zhang, Jiaxin Huang2026-05-18