💬 NLP

Divergent large language model predictions from convergent representations in ambiguous word pairs

تكشف هذه الدراسة أن نماذج المحولات القائمة على فك التشفيد فقط (decoder-only transformers) تحل الغموض المعجمي من خلال التباعد أولاً ثم إعادة التقارب جزئياً في تمثيلاتها الداخلية في الطبقات المتأخرة، مما يخلق انفصالاً حيث تستمر التمايزات الدلالية في دفع تنبؤات متميزة رغم أنها تصبح غير مرئية لمقاييس تشابه التضمين القياسية.

K. Jack Scott, Narun Pat, Veronica Liesaputra2026-08-04
🤖 AI

Diagnosing Search Behavior and Failure Modes in Long-Horizon Search Agents

تشخص هذه الورقة البحثية وكلاء البحث طويل الأمد من خلال التمييز بين إخفاقات الاسترجاع وإخفاقات الاستخدام، كاشفةً أن دقة الإجابة ترتبط بجودة الأدلة المسترجعة ارتباطاً أقوى من ارتباطها بجهد البحث، ومقترحةً أن تحسين صياغة الاستعلام، واختيار الأدلة، ومعايير التوقف التكيفية هي المفاتيح لبناء أنظمة بحث عميق أفضل.

Qi Liu, Jiaxin Mao, Fengbin Zhu, Tat-Seng Chua2026-08-04
🤖 machine learning

HarnessCompass: Guiding Automatic Harness Evolution toward Generalizable and Effective Agent Harnesses

يُعد HarnessCompass إطار عمل مبتكرًا للتطور التلقائي للمقيدات (harness evolution)، يعمل على تعزيز أداء الوكلاء وقدرتهم على التعميم من خلال فرض قيود غير مرتبطة بمهام محددة، ودمج التغذية الراجعة الاستباقية من الوكيل، وفصل تحسين المكونات، مما يحقق نتائج متفوقة على SWE-bench Verified مقارنة بالأساليب الحالية.

Luan Zhang, Ruochen Zhou, Dandan Song, Zhengyu Chen, Yuhang Tian, Jun Yang, Huipeng Ma, Chenhao Li, Guangyuan Feng, Xudo (…)2026-08-04
💬 NLP

Automatic Annotation of Ancient Greek Vowel Length

تقدم هذه الورقة أول نظام عام الأغراض وقائم على القواعد لتحديد طول الحروف (macronizer) للغة اليونانية القديمة، والذي يقوم تلقائياً بتوسيم طول الحروف المتحركة في الحروف ثنائية الزمن (dichrona letters) باستخدام السياق الصرفي، وتُثبت أن مخرجاته تدرب بفعالية نموذج محول على مستوى الحرف (character-level transformer) لتحقيق دقة عالية في كل من الشعر والنثر مع تحسين المهام العروضية اللاحقة.

Albin Thörn Cleland, Eric Cullhed2026-08-04
💬 NLP

CompanionBench: A Theory-Anchored, Real-World-Grounded Benchmark for AI Emotional Companionship

يقدم CompanionBench معياراً مرجعياً ثنائي اللغة جديداً، مرتكزاً على النظرية ومستنداً إلى الواقع، يقيم الرفقاء العاطفيين القائمين على الذكاء الاصطناعي من خلال سيناريوهات تفاعلية ومحاكي مستخدم مُدرب، كاشفاً أن الوكلاء الحاليين غالباً ما يعطون الأولوية للدفء السطحي على حساب الدعم العلاقاتي الجوهري، ومبرزاً نقاط ضعف كبيرة في قدرات مثل تنظيم العواطف والتحدي المتزن.

Yao Liu, Guangjia Chai, Yuming Huang, Jihao Huang, Lei Wang, Junchen Wan2026-08-04
💬 NLP

TextNCA: Neural Cellular Automata for Language Modeling via Hierarchical Local Attention

تقدم هذه الورقة TextNCA، وهو خلية عصبية خلوية هرمية (hierarchical Neural Cellular Automaton) لنمذجة اللغة، لتثبت أن جدول الانتباه المتدرج من الضيق إلى الواسع هو المحرك الرئيسي للأداء، بينما توفر التكرارات والمكونات المعمارية المحددة فوائد أصغر ومحدودة.

Avni Mittal, Avinash Anand, Ashutosh Kumar, Dikshant Kukreja, Kritarth Prasad, Sushane Dulloo, Erik Cambria, Timothy Liu (…)2026-08-04
🤖 machine learning

Geometry-Guided Layerwise FFN Width Allocation in Transformers

تقترح هذه الورقة طريقة موجهة هندسياً لتخصيص عرض شبكة التغذية الأمامية (FFN) ديناميكياً عبر طبقات المحولات بناءً على مقاييس هندسية مثل تشوه "غرووموف-واسرشتاين" والتماثل المستمر، مما يثبت أن مثل هذه الجداول الزمنية القائمة على البيانات تقلل بشكل كبير من فقدان التحقق مقارنة بتخصيصات العرض الموحدة أو المصممة يدوياً.

Timur Mudarisov, Mikhail Burtsev, Radu State2026-08-04
🤖 AI

Instruction-Conditioned Exploration with Asymmetric Reinforcement Learning and Self-Distillation

تقترح هذه الورقة البحثية آلية الاستكشاف المشروط بالتعليمات (ICE) مدمجة مع هدف التعلم التعزيزي غير المتماثل والتقطير الذاتي لتعزيز استكشاف النماذج اللغوية الكبيرة ونقل السلوكيات المتنوعة إلى سياسة وقت الاختبار، مما يحقق مكاسب كبيرة في الأداء في مهام الاستدلال الرياضي.

Jim Dilkes, Vahid Yazdanpanah, Sebastian Stein2026-08-04
💬 NLP

Cross-Domain Hybrid OPD for Generalizable Search Agents

تقدم هذه الورقة إطار تدريب هجين لوكيل البحث "Yuanbao" يستخدم تقنية "التقطير في السياسة" (On-Policy Distillation) لخبراء عبر المجالات لتحقيق قدرات بحث متخصصة دون التضحية بالذكاء العام، بل وتعزيزه، مما يقلل من "ضريبة المحاذاة" المعتادة المرتبطة بتحسين التعلم التعزيزي.

Hongzhan Chen, Xiaoyu Liu, Dengming Zhang, Minzhou Huang, Dongliang Xu, Jingcheng Xie, Dongxiang Fang, Bowen Qin, Minshe (…)2026-08-04
💬 NLP

Douyin Multimodal Embedding Model Technical Report

تقدم الورقة البحثية نموذج "تضمين دوين متعدد الوسائط" (DME)، وهو نموذج مدرب على مرحلتين يحقق أداءً هو الأفضل في فئته وكفاءة إنتاجية من خلال الجمع بين التدريب المسبق التبايني واسع النطاق وآليات تدريب مبتكرة للاستدلال القائم على الأدلة وإعادة البناء المشروط متبادلاً، مما يوفر تمييزاً متعدد الوسائط دقيق التفاصيل دون المساس بسرعة الاستدلال عبر الإنترنت.

Haonan Chen, Chu Li, Zhicheng Wang, Yuanwei Liu, Yuanjiang Wang, Shaohua Jiang, Zhicheng Dou2026-08-04