💻 computer science

Solver-Aware Decompositions for Programming-by-Example: When Dividing Requires Knowing how to Conquer

تقدم هذه الورقة البحثية إطار عمل "التفكيك المدرك للمحلل" (SAD)، وهو إطار تدريب يحسن عملية التوليف عبر البرمجة بالمثال من خلال تحسين المفككات لتكون قابلة للتتبع من قبل المحلل بدلاً من الالتزام الصارم بالأهداف الفرعية للأرضية الحقيقية، مما يثبت أن جودة التفكيك نسبية بالنسبة للمحلل وأن المطابقات غير المثالية للأرضية الحقيقية يمكن أن تؤدي إلى أداء فائق في نهاية المطاف.

Janis Zenkner, Tobias Sesterhenn, Tim Grams, Christian Bartelt2026-08-05
💬 NLP

ChartAnno: Evaluating MLLMs for Chart Annotation Generation

تقدم هذه الورقة ChartAnno، وهو معيار مرجعي يضم 1,200 مخطط من العالم الحقيقي صُممت لتقييم قدرات النماذج اللغوية الكبيرة متعددة الوسائط في توليد تعليقات توضيحية للمخططات، مما يكشف أنه بينما تحقق التعليمات المحددة والنماذج المملوكة نتائج أفضل، فإن استنتاج القصد المجرد والاستفادة من صور المخططات لا يزالان يشكلان تحديات كبيرة.

Zhenghan Chen, Zekai Shao, Lidan Tan, Xin Lin, Xingchen Zeng, Yi Shan, Ziyue Lin, Xiaoliang Fu, Xinyuan Liu, Yuetong Guo (…)2026-08-05
💬 NLP

Adaptive Modality Reliability Diagnosis and Restoration for Robust Multimodal Intent Recognition

تقدم الورقة البحثية إطار عمل PRIME، وهو إطار عمل مغلق الحلقة يشخص نقاط ضعف الأنماط باستخدام تباين السجل السياقي، ويستعيد التمثيلات المتدهورة عبر وحدة تباينية مشروطة بالنموذج الأصلي، ويعيد تقييم الموثوقية لتمكين التعرف القوي على النوايا متعدد الوسائط في ظل ظروف الضجيج أو الفقدان أو التعارض.

Suraj Kumar, Mohnish Raj, Soumi Chattopadhayay, Chandranath Adak, Ayan Dutta2026-08-05
💻 computer science

Leveraging System-Level Observations to Inform Bayesian Learning of Model Parameters for Quantitative Verification

تقدم الورقة البحثية EPIK، وهو نهج مبتكر يعزز التعلم البايزي للتحقق الكمي من خلال الاستفادة من خصائص النظام القابلة للملاحظة مباشرة لاستقاء وتضمين المعرفة المسبقة، وبالتالي التغلب على قيود الاعتماد على افتراضات غير دقيقة أو غير غنية بالمعلومات حول معلمات النموذج الرسمي.

Simos Gerasimou, Xingyu Zhao2026-08-05
💻 computer science

WeClawArena: An Auditable Sandbox and Benchmark for Cross-User Agents Collaboration and Security in Human-Centered Agent Networks

تقدم هذه الورقة WeClawArena، وهي بيئة تجريبية ومعيار قياس قابل للتدقيق مصمم لتقييم فائدة وأمن التعاون بين الوكلاء عبر المستخدمين في الشبكات المتمحورة حول الإنسان، وذلك من خلال محاكاة التفاعلات متعددة الأطراف عبر مساحات العمل الشخصية باستخدام 620 نوعاً من المهام التي تشمل سيناريوهات حميدة وعدائية.

Prince Zizhuang Wang, Aojie Yuan, Haiyue Zhang, Xiyang Hu, Yue Zhao, Shuli Jiang2026-08-05
📊 statistics

When Many Answers Are Valid, Voting Fails: Symbolic Verification for Best-of-K Causal Reasoning in LLMs

يقدم البحث CALVER، وهو مُتحقق رمزي لا يتطلب تدريباً يتفوق على طرق التصويت القائمة على المكافأة التقليدية في الاستدلال السببي، وذلك عبر تقييم مسارات الاستدلال المهيكلة مقابل معايير بيرل السببية لتحديد الإجابات الصحيحة حتى في حالة وجود حلول متعددة صحيحة.

Omatharv Bharat Vaidya, Connor Thomas Jerzak, Zayne Rea Sprague, Fangcong Yin, Nhat Ho2026-08-05
💻 computer science

Reversing Arrows in Large Language Models

تقدم هذه الورقة أول دراسة منهجية حول كيفية تعامل النماذج اللغوية الكبيرة مع اتجاهية العلاقة العكسية، مما يكشف عن عدم تماثل منهجي في أداء التصنيف لديها، ويوضح أن دقة النموذج حساسة لتمثيلات الكيانات بينما لا تعمل أوصاف العلاقات على تحسين النتائج بشكل ثابت.

Sefika Efeoglu, Adrian Paschke2026-08-05
💻 computer science

Dr. AGENTONOMICS: A Didactic Experiment of AGENTONOMICS

تقدم هذه الورقة "دكتور أجينتونو ميكس" (Dr. AGENTONOMICS)، وهو تجربة تعليمية ومعلم قائم على الويب يعمل ككِلا الموضوع والوسيط لتدريس إطار عمل "أجينتونو ميكس"، مع خارطة طريق للتطور إلى محاضر متعدد الوسائط، ومستشار تصميم، وعميل فائق (meta-agent) ضمن اقتصاد ذكاء اصطناعي متعدد المراكز.

Fengjunjie Pan, Alois Knoll2026-08-05
💻 computer science

Soft Guidance Starts to Outperform CoT Prompting as LLMs Improve

تجادل الورقة البحثية بأنه مع تحسن النماذج اللغوية الكبيرة، غالبًا ما يؤدي أسلوب "سلسلة الأفكار" (Chain-of-Thought) القائم على التلقين بلقطات قليلة (few-shot) إلى إعاقة الأداء من خلال فرض قيود تشتت الانتباه تتعلق بالتنسيق والأسلوب، مما يجعل أساليب "الصفر لقطة" (zero-shot) البسيطة أكثر فعالية في مهام الاستدلال.

Denys Pushkin, Albert Q. Jiang, Aryo Lotfi, Colin Sandon, Emmanuel Abbé2026-08-05
🤖 machine learning

Pin Once, Swap Light: Subspace-Aligned Centroid-Residual Training for Efficient Ultra-LoRA Serving

تقترح الورقة البحثية إطار عمل SALT، وهو إطار ضبط دقيق هرمي ثلاثي المراحل يعمل على فك الارتباط بين المعرفة بالمجال وبين مراكز الثقل عالية السعة والمثبتة وبقايا المهام ذات الرتبة شديدة الانخفاض، مما يتيح خدمة LoRA متعددة المستأجرين بكفاءة مع تقليل استهلاك الذاكرة وحمل PCIe بشكل كبير مع استعادة دقة الرتبة العالية.

Xiang Li, Pengcheng Wang, Huazheng Wang, Saurabh Bagchi2026-08-05