💬 NLP

Crayotter: Learning Long-Horizon Video Editing Agents via Group-Relative Preference Backpropagation

تقدم الورقة البحثية Crayotter، وهو وكيل تحرير فيديو بحجم 9 مليارات معلمة تم تدريبه عبر الانتشار العكسي للتفضيلات النسبية للمجموعات (GRPB)، والذي يحول التغذية الراجعة الذاتية لتحرير طويل المدى إلى مقارنات ترتيبية لإعادة توزيع الائتمان بفعالية عبر الأجزاء الدلالية، متفوقاً بذلك على الأنظمة المملوكة في اختبارات معيارية مثل AgenticVBench.

Lecheng Yan, Jianze Lin, Yichong Zhang, Ben Pan, Wenxi Li, Chenyang Lyu, Liting Zhou, Cathal Gurrin2026-08-05
💬 NLP

ARCHead: Activation-Metric Residual Correction for Large Language Model Output Heads

تُعدُّ ORCHead طريقةً مبتكرةً لتصحيح المتبقي عبر مقياس التنشيط، حيث تقوم بضغط رؤوس مخرجات النماذج اللغوية الكبيرة باستخدام جوهر منخفض الرتبة مُكمَّم ومتبقيات INT4 مجموعية، مما يحقق اختزالاً كبيراً في التخزين (3.7–3.9 ضعفاً) مع الحفاظ على تشتت قريب من غير منقوص وتأثير ضئيل على معدل الإنتاجية.

Şuayp Talha Kocabay, Talha Rüzgar Akkuş, Kamer Ali Yuksel2026-08-05
💬 NLP

Search, Inspect, Fetch: Exploiting Boolean Retrieval for Deep-Research Agents

تقدم الورقة البحثية SIEVE، وهي واجهة وكيل بحث عميق تستفيد من الاسترجاع البولياني الميداني لتصفية وترتيب وجلب الأجزاء ذات الصلة فقط من المستندات، مما يحقق دقة أعلى بعدد أقل بكثير من الرموز (tokens) مقارنة بسير عمل البحث والزيارة التقليدي.

Shuai Wang, Haodong Chen, Yu Yin, Shengyao Zhuang, Bevan Koopman, Guido Zuccon2026-08-05
💬 NLP

CURV: Enhancing Chart Understanding Through Curriculum Visual Grounded Reasoning

تقدم الورقة البحثية CURV، وهو إطار عمل للتعلم المنهجي مقترن بمجموعة بيانات CCQA، والذي يعزز الإجابة على الأسئلة المتعلقة بالمخططات البيانية من خلال تدريب النماذج متعددة الوسائط على أداء استدلال بصري جوهري متعدد الخطوات ومرتبط بالواقع، مما يؤدي إلى تحسينات كبيرة في الأداء عبر مختلف المعايير المرجعية.

Xuehang Guo, Pingyue Zhang, Ruiyi Zhang, Zhenhailong Wang, Hanrui Lyu, Heng Ji, Tong Sun, Qingyun Wang, Manling Li2026-08-05
💬 NLP

LACE: Large Language Model Aided Multi-Agent Framework for Agile RISC-V Instruction Extension

إن LACE هو إطار عمل متعدد الوكلاء مدعوم بالنماذج اللغوية الكبيرة (LLM) يعمل على أتمتة ترجمة نوايا توسعة تعليمات RISC-V من اللغة الطبيعية إلى كود RTL تم التحقق منه وفحوصات مستقلة عن المترجم، مما يحسن دقة التوليد بشكل كبير ويقلل من إعادة عمل التكامل عبر النوى المتنوعة.

Pingqing Zheng, Jiayin Qin, Fuqi Zhang, Zishen Wan, Shang Wu, Yu Cao, Caiwen Ding, Yang Katie Zhao2026-08-05
💬 NLP

FLARE: Few-shot Learning-based Adaptive Reflective Engine

تقدم الورقة البحثية FLARE، وهو إطار عمل قائم على التعلم بلقطات قليلة يستفيد من آليات انعكاسية تكيفية للتفوق على مُحسّن GEPA المتطور عبر مختلف المعايك، مما يظهر دقة واستقراراً وكفاءة في البيانات متفوقة في ضبط التعليمات للجيل القادم من النماذج اللغوية الكبيرة.

Dhanasekar Sundararaman, Bharat Gandhi, Aashna Garg, Minjie Li2026-08-05
💬 NLP

Hypercubes, Hyperplanes, and Constraint-Induced Complexity Collapse in Atomic Concept Learning

تُثبت هذه الورقة أن التعقيد المنطقي لتعلم المفاهيم الذرية ذات الترتيب الأعلى ليس موزعاً بشكل موحد عبر مكعب الفرضيات الذرية، بل هو محلي ومقيد بهندسة المستويات الفائقة، حيث تنهار المستويات الفائقة غير القطرية إلى فئات تكافؤ محدودة بينما يظل القطر الكامل هو المصدر الوحيد للتعقيد غير المحدود.

Irene Tsapara2026-08-05
💬 NLP

Character Iconicity vs. Arbitrariness: An Arabic NLP Perspective

تُثبت هذه الورقة أن أداء معالجة اللغات الطبيعية للغة العربية يعتمد أساساً على البنى التوزيعية المستقرة بدلاً من الأيقونية البصرية لأشكال الحروف، حيث تحقق عمليات إعادة تعيين الرموز التعسفية القائمة على تجميعات الرسم غير المنقوط نتائج تنافسية عبر مهام متنوعة مع تقليل حجم المفردات وتكاليف التدريب بشكل كبير.

Dorieh Alomari, Irfan Ahmad, Maged S. Al-shaibani2026-08-05
💬 NLP

Every Wrong Answer Counts: Option-Level Psychometrics for LLM Multiple-Choice Benchmarks

تقدم هذه الورقة نموذج الاستجابة الاسمية للنماذج اللغوية الكبيرة (LLM-NRM)، وهو إطار عمل سيكومتري يستفيد من التوزيع الكامل لخيارات الإجابة —بما في ذلك الخيارات غير الصحيحة— لتقدير قدرات النماذج اللغوية الكبيرة وخصائص العناصر بدقة أكبر، مما يثبت أن تفضيلات المشتتات توفر قيمة قياس كبيرة وتتيح اختباراً معيارياً عالي الكفاءة مقارنة بالتسجيل الثنائي التقليدي.

Xiao Fei, Yang Zhang, Sarah Almeida Carneiro, Michalis Vazirgiannis2026-08-05
💬 NLP

Mapping the City Through the Lens of Language Models

يتتبع هذا البحث تجريبياً كيف تفترض النماذج اللغوية ضمناً وجود مدينة "عادية" من خلال تقييم ملفات تعريف حضرية مجهولة المصدر عبر 40 مؤشراً، مما يكشف عن انحياز مشترك نحو الأشكال الحضرية الأكبر والأسرع نمواً والأكثر كثافة في البنية التحتية حيث غالباً ما يتطابق النمط المألوف مع الجاذبية.

Wanqi Liu, Rong Zhao, Zhizhou Sha, Qinyu Cui, Yecheng Zhang2026-08-05