🤖 AI

From Errors to Proofs: Minimal-Core-Guided Repair for Neuro-Symbolic Constraint Solving

تقترح هذه الورقة طريقة إصلاح موجهة باللب الأدنى (minimal-core-guided) لحل القيود العصبي-الرمزي، تستبدل أخطاء الحلول العامة بنوى عدم إرضاء دقيقة لتحديد مواقع أخطاء الترجمة، مما يقلل بشكل جذري من فبركة الحلول ويضمن حل المشكلات بموثوقية حتى عندما تكون الترجمة الأولية غير أمينة.

Dipankar Sarkar2026-08-18
💻 computer science

Beyond Tokens: A Survey on Decoding Methods for Large Language and Vision-Language Models

تستعرض هذه الدراسة المسحية بشكل منهجي طرق فك التشفير الناشئة للنماذج اللغوية الكبيرة ونماذج اللغة والرؤية، حيث تصنفها إلى ثلاثة نماذج لتسليط الضوء على كفاءتها في محاذاة مخرجات النماذج مع قصد المستخدم أثناء الاستدلال، مع تحديد التحديات الحالية واتجاهات البحث المستقبلية.

Haoran Wang, Xiongxiao Xu, Philip S. Yu, Kai Shu2026-08-18
🤖 AI

Do LLMs Know What to Ask and When? Evaluating Multi-Turn Information Seeking

تقدم هذه الورقة MT-InfoSeek، وهي مجموعة تقييم مضبوطة تُظهر أنه بينما تستطيع النماذج اللغوية الكبيرة إدراك الحاجة إلى معلومات إضافية في المهام متعددة الأدوار غير محددة المواصفات، إلا أنها تقلل بشكل منهجي من مقدار المعلومات المطلوبة، وتفشل في تحديد الاستعلامات الدنيا الكافية، وتواجه صعوبة في ترتيب الاستعلامات، مما يكشف عن فجوة متميزة بين قدراتها في البحث عن المعلومات ومقاييس التقييم الحالية.

Yepeng Huang, Jiawen Zhang, Michelle Dai, Xiaorui Su, Shanghua Gao, Zi Wang, Marinka Zitnik2026-08-18
💻 computer science

Beyond the pale: Assessing prevalence and contents of extremist speech in LLM training data

تبحث هذه الورقة في مدى انتشار خطاب التطرف في مجموعة بيانات تدريب "دولما" (Dolma)، كاشفةً أنها قد تحتوي على مئات الآلاف من الوثائق التي تتضمن خطاب كراهية ودعوات للعنف، مما يسلط الضطوء على التداعيات الحرجة المتعلقة بتنقيح البيانات وسلامة النماذج اللغوية الكبيرة.

Dmitry Nikolaev, Ashley A. Mattheis2026-08-18
💻 computer science

Writing Style Similarity Reflects Academic Genealogy

تُظهر هذه الورقة أن النسب الأكاديمي يؤثر بشكل كبير على أسلوب الكتابة، حيث يبدي المشرفون وطلابهم (وكذلك الأشقاء الأكاديميون) تشابهاً أسلوبياً أعلى بكثير من الأقران العشوائيين، مما يؤدي إلى معدل مرتفع من أخطاء الخطأ في النسبة في أنظمة كشف التأليف التي تفشل في مراعاة هذه السمات الأسلوبية الموروثة.

Cameron Manzo2026-08-18
💻 computer science

What to Forget in Unlearning? Forget Set Curation for Language Models

تقدم هذه الورقة CleanSlate، وهو معيار مرجعي يوضح أن تنسيق مجموعات النسيان يمثل تحدياً جوهرياً في مرحلة ما قبل عملية "إلغاء التعلم الآلي"، حيث تفشل طرق الاختيار البسيطة في كبح المحتوى المستهدف، بينما تتسبب الاستراتيجيات المفرطة في القوة في أضرار جانبية كبيرة لقدرات النموذج.

Animesh Jha, Arpandeep Khatua, Youssef Allouah, Sanmi Koyejo2026-08-18
🤖 machine learning

Workspace Topology as an Attack Vector in Agentic Coding Assistants

تثبت هذه الورقة تجريبياً أن "طوبولوجيا مساحة العمل" لبيئة المطور — والتي تشمل عوامل مثل عمق المجلدات، ونمطية الكود المصدري، وتأطير السياق — تؤثر بشكل كبير على معدل نجاح هجمات حقن الأوامر غير المباشرة ضد مساعدي البرمجة الوكيلين، حيث تعمل الهياكل عالية النمطية والإشارات الأمنية على تقليل الضعف بشكل ملحوظ.

Alexandre G. R. Day, Pradeep Yadlapalli, Sriram Venkatapathy, Thomas Paniagua, Nick Raines, Sahil Wadhwa, Himanshu Kumar (…)2026-08-18
🤖 machine learning

Interpretable Cross-Lingual Alignment in Small Language Models: Probing Cultural and Pragmatic Reasoning in Japanese-English Bilingual LLMs

تقدم هذه الورقة البحثية J-PragEval-v0، وهو معيار للأزواج الدنيا للظواهر البراغماتية في اللغة اليابانية، وتستخدم سبر الخطوط المستقيمة وتوجيه التنشيط على نموذج ثنائي اللغة بحجم 1.5 مليار معلمة لتوضيح أنه بينما يمكن فك تشفير صيغ التبجيل خطياً في التدفقات المتبقية، فإن التباينات البراغماتية الأخرى مثل الموضوعات الضمنية والإشارات داخل المجموعة يتم حلها أثناء التوليد بدلاً من تخزينها عند المطالبة.

Florian Braun2026-08-18
💻 computer science

How Do Agents Fail on AutoResearch: End-to-End Diagnostic Evaluation on 100 Real-World Frontier Research Tasks

تقدم هذه الورقة AutoResearchEval، وهو إطار تشخيصي يتكون من 100 مهمة بحثية من واقع العالم الحقيقي وتصنيف للفشل يضم 45 نمطاً، ليكشف أن وكلاء البحث المستقلين الحاليين عبر جميع النماذج والهياكل المختبرة يفشلون بشكل منهجي بسبب الافتقار إلى حلقات الميتا-معرفية (metacognitive loops) للتصحيح الذاتي والتحقق من المسار.

Yanlin Fei, Nazhou Liu, Xinmiao Yu, Shaolong Chen, Lei Li, Rahul Thapa, Madalina Ciobanu, Qingqing Mao, Ritankar Das2026-08-18
📊 statistics

Optimal Watermark Localization in Mixed-Source Large Language Model Texts

تصيغ هذه الورقة البحثية تحديد موقع العلامة المائية في نصوص النماذج اللغوية الكبيرة ذات المصادر المختلطة كمسألة اختبار متعدد على مستوى الرمز (token)، مع وضع انتقالات طورية نظرية للكشف والتصنيف، واقتراح طريقة عتبة تكيفية تحقق قوة اكتشاف مثلى دون الحاجة إلى معرفة مسبقة بمدى تشتت الإشارة أو معاملات التوزيع.

Jose H. Blanchet, T. Tony Cai, Xiang Li, Hao Liu, Qi Long, Weijie J. Su2026-08-18