💬 NLP

VisEditBench: Can Vision-Language Models Edit Visualization Code from Multimodal Feedback?

تقدم هذه الورقة VisEditBench، وهو معيار شامل يتكون من 1,395 مهمة مشروحة بشرياً صُممت لتقييم قدرة نماذج الرؤية واللغة على تحرير كود التصور البياني بناءً على تغذية راجعة متعددة الوسائط، مما يكشف عن فجوات أداء كبيرة في النماذج الحالية ويقترح VisEditAgent، وهو إطار عمل قائم على الرندرة (الصيرورة) يحسن دقة التحرير بشكل كبير.

Mizanur Rahman, Arshia Azimlu, Shadikur Rahman, Md Tahmid Rahman Laskar, Amran Bhuiyan, Shafiq Joty, Enamul Hoque Prince2026-08-12
💬 NLP

How Robust Are LLMs to Vietnamese Dialects?

تقدم هذه الورقة VialectBench، وهو أول معيار منهجي لتقييم النماذج اللغوية الكبيرة في اللهجات الفيتنامية، والذي يكشف أن الاختلافات اللهجية تسبب تدهوراً ملموساً في الأداء عبر مهام متعددة، ويثبت أن الكفاءة العالية في اللغة الفيتنامية القياسية لا تضمن المتانة تجاه الاختلافات الإقليمية التي تحافظ على المعنى.

Minh Tran, Trinh Chau, Thanh-Nhan Le, Nam Tran, Luan Thanh Nguyen, Cuong Dang, Duc Hoang2026-08-12
💬 NLP

MD-ProTector: Positioning Multiple Data-Driven Prototypes for LLM-Generated Text Detection

يعزز MD-ProTector الكشف عن النصوص المولدة بواسطة النماذج اللغوية الكبيرة (LLMs) من خلال توظيف نماذج أولية متعددة قابلة للتدريب لكل فئة ضمن فضاء تضمين المشفر، مسترشداً بخسارة تموضع النماذج الأولية المبتكرة لنمذجة تنوعات الكتابة المتنوعة بفعالية وتحقيق أداء فائق عبر مختلف المجالات واللغات ونماذج التوليد.

Jinmo Han, Jimin Hong, Chanyeong Moon, Ju Yeon Kang, Seonuk Kim, Nam Soo Kim2026-08-12
💬 NLP

Lost in Reconstruction: Aligning Action Representations with Language in Vision-Language-Action Models

تقدم الورقة البحثية SALT، وهو أداة ترميز أفعال متوافقة دلالياً تعزز أهداف إعادة البناء القياسية بمهمة استرداد لغوية مساعدة للحفاظ على معلومات ربط الأفعال في التمثيلات الكامنة للأفعال، مما يحسن بشكل كبير من أداء التحكم في الروبوتات المشروط باللغة مقارنة بالنماذج المرجعية التي تقتصر على إعادة البناء فقط.

Li Wenjie, Yash Jangir, Ignacy Stepka, Yash Agarwal, Marion Kipsang, Yonatan Bisk2026-08-12
💬 NLP

Every Token Counts: Exact Likert-Scale Distributions for Measuring LLM Attitudes and Biases

تقدم هذه الورقة إطاراً دقيقاً تحليلياً يجمع بين التجارب العاملية كاملة التقاطع مع تحليل الاحتمالات على مستوى الرمز (token) لقياس مواقف وتحيزات النماذج اللغوية الكبيرة بدقة، متجاوزةً بذلك الغموض السببي الذي تعاني منه الاختبارات المعيارية التقليدية غير المهيكلة.

Davood Wadi, Mohsen Ghodrat, Matthew Philp2026-08-12
💬 NLP

Decomposition-Induced Context-Memory Conflict: When Fact-Checking Pipelines Contradict Their Own Source Text

تحدد هذه الورقة وتُوصّف "صراع ذاكرة السياق الناجم عن التفكيك" (DI-CC)، وهو نمط فشل في مسارات التحقق من الحقائق حيث تقوم مرحلة التفكيك باستبدال معتقدات النموذج البارامترية بالنص المصدر، مما يخلق تناقضات تتملص من الكشف القياسي عن الاتساق الذاتي ولكن يمكن التخفيف منها جزئياً عبر فك التشفير المدرك للسياق على حساب موثوقية التحليل.

Yu-Feng Yen2026-08-12
💬 NLP

InSight-doc: Agentic Visual Perception for Long-Document Understanding

يُعد InSight-doc إطار عمل إدراكي بصري وكيلّي يقوم بالتكبير التكيفي للمناطق عالية الدقة في المستندات الطويلة لتحسين الدقة بشكل كبير، وتقليل الهلوسة، وخفض زمن استجابة الاستدلال دون الاعتماد على مسترجعات خارجية.

Kaican Li, Weiyan Xie, Lewei Yao, Jiannan Wu, Lanqing Hong, Yongxiang Huang, Nevin L. Zhang2026-08-12
💬 NLP

DistilVDR: A Compact End-to-End Visual Document Retriever via Dual-Student Distillation

يُعد DistalVDR مسترجع وثائق مرئية مدمجاً وشاملاً بـ 524 مليون معلمة، يستخدم تقنية التقطير ثنائي الطالب من معلم مجمد بسعة 8 مليارات معلمة لتحقيق أداء استرجاع عالٍ وفهرسة أسرع وأصغر حجماً بشكل ملحوظ دون الحاجة إلى تسميات صلة أو تدريب تبايني.

Zhuchenyang Liu, Ziyi Wang, Yao Zhang, Yu Xiao2026-08-12
💬 NLP

Auditing Chinese Web-scale Corpora via Sampled BPE Token Statistics

تقدم هذه الورقة البحثية Sampled-BPE، وهو مسار تدقيق خفيف الوزن على مستوى الرمز (token-level) يحدد بكفاءة التلوث في مجموعات البيانات الصينية واسعة النطاق عبر تدريب أجهزة ترميز BPE على عينات صغيرة، مما يكشف عن تلوث واسع الانتشار ومتغير عبر مجموعات البيانات المفتوحة مع توفير مجموعة بيانات هرمية لمزيد من التحليل.

Qingjie Zhang, Ziqi Tang, Jie Zhang, Gelei Deng, Jinfeng Li, YueFeng Chen, Yitong Yang, Hui Xue, Tianwei Zhang, Han Qiu2026-08-12
💬 NLP

ENTLORE: A Graph-Grounded Benchmark for Latent Organizational Reasoning in Enterprise Question Answering

تقدم هذه الورقة ENTLORE، وهو معيار قائم على الرسوم البيانية يقيم أنظمة الإجابة على الأسئلة في المؤسسات بناءً على قدرتها على إجراء الاستدلال التنظيمي الكامن من خلال إعادة بناء عوالم مؤسسية مدققة من الوثائق الروتينية لاختبار استعادة العلاقات الضمنية بما يتجاوز مجرد استرجاع الحقائق البسيطة.

Akrin Zheng, Alexander Wu, Alaia Liu2026-08-12