💻 computer science

HetRoute Heterogeneous and Cost-aware Collaborative Routing Framework for Distributed Edge MoE Inference

تقترح هذه الورقة HetRoute، وهو إطار عمل للتوجيه التعاوني لاستنتاج نماذج خليط الخبراء (MoE) الموزعة عند الحافة، والذي يوحد تكاليف الإرسال والحوسبة والجودة في نموذج واحد لتحسين وضع الخبراء والتوجيه عبر الإنترنت، محققاً بذلك تخفيضات كبيرة في زمن الاستجابة وحركة المرور مع الحفاظ على قيود الجودة.

Xin Yuan, Ning Li, Wenchao Xu, Athanasios V. Vasilakos, Song Guo, Haijun Zhang2026-08-04
💬 NLP

Loanword or Switch? The Annotation Boundary, Not the Model, Drives Kazakh-Russian Code-Switching Identification

تجادل هذه الورقة بأن التحدي الرئيسي في تحديد التبديل اللغوي بين الكازاخية والروسية لا يكمن في اختيار نموذج تحديد اللغة، بل في حدود التوسيم التي تميز بين الكلمات المستعارة المدمجة والتبديل اللغوي الفعلي، وهو تمييز تم توضيحه من خلال مجموعة بيانات ذهبية جديدة كليًا على مستوى المستند ومنهج نهجي يعتمد على التصفية أولاً.

Bogdan Savelyev2026-08-04
💬 NLP

Verification Without Sufficiency: Per-Chunk Filtering Fails on Multi-Hop RAG, and Decomposition Repairs It

تُثبت هذه الورقة أن التحقق القياسي لكل جزء (per-chunk) يفشل في أنظمة التوليد المعزز بالاسترجاع متعدد القفزات (multi-hop RAG) لأن أي وثيقة مسترجعة بمفردها لا تكون كافية للإجابة على السؤال، وتقترح أن جعل عملية التحقق مشروطة بأسئلة فرعية مفككة يعالج هذا القصور بفعالية من خلال تحسين درجات الاستلزام بشكل كبير.

Randhir Kumar2026-08-04
💬 NLP

A Heuristic Perspective on Debiasing Language Models

تقدم هذه الورقة HEIMAT، وهو إطار عمل آلي لإزالة التحيز قائم على الاستدلال يجمع بين الكشف عن التحيز الموجه بالقوالب وبين الضبط الدقيق لتقليل التباين من أجل التخفيف بفعالية من التحيزات الثقافية في النماذج اللغوية مع الحفاظ على قدراتها في فهم اللغة الطبيعية، مما يوفر بديلاً قابلاً للتوسع للطرق الحالية المكلفة.

Tian Lan, Yemin Wang, Chuancheng Shi, Xiangyu Wu, Zesheng Shi, Yuan Wang, Jiang Li, Guanglai Gao, Xiangdong Su2026-08-04
💬 NLP

TreeProbe : A Tibetan Medicine Benchmark for Cultural Bias in LLMs

تقدم هذه الورقة TreeProbe، وهو أول معيار اختبار صُمم لتقييم التحيز الثقافي في النماذج اللغوية الكبيرة من خلال اختبار مدى التزامها بالإطار النظري الهيكلي للطب التبتي، مما يكشف أن النماذج الحالية غالباً ما تظهر انحرافاً معرفياً منهجياً نحو نماذج الطب الحيوي السائدة أو الطب الصيني التقليدي.

Jin Zhang, Linyu Li, Weili Jiang, Yuqing Cai, Yutong Liu, Guanquecairang, Yongbin Yu, Jingye Cai, Nyima Tashi, Gadeng L (…)2026-08-04
💬 NLP

OpenART: Scaling Agent Red Teaming via Open-Ended Environment Evolution

تقدم الورقة البحثية OpenART، وهي ساحة مفتوحة وقابلة للتوسع تضم أكثر من 10,000 سيناريو حالة، وطريقة هجوم المخطط الفائق التطور لـ ماركوف (EMHA)، والتي تثبت أن تطور حالات البيئة يكشف بشكل كبير عن إخفاقات السلامة في وكلاء الذكاء الاصطناعي التي تغفلها الاختبارات المعيارية الثابتة التقليدية، محققةً معدل نجاح هجوم بنسبة 85.0% عبر تكوينات متنوعة.

Yunhao Chen, Xin Wang, Yixu Wang, Yi Liu, Jie Li, Yan Teng, Xingjun Ma, Xia Hu, Yu-Gang Jiang2026-08-04
💬 NLP

RAGOCR: Optical Compression of Retrieval-Augmented Text via Visual Representation

يُعد RAGOCR إطار عمل مبتكرًا يقوم بضغط المستندات المسترجعة إلى تمثيلات بصرية مشروطة بالاستعلام مع آلية دقة ديناميكية، محققًا دقة أعلى بنسبة تزيد عن 15% من نظام RAG القياسي مع تقليل الرموز المدخلة بنسبة 87.5% والتفوق على النماذج المرجعية الحالية للضغط الصلب واللين.

Jiayang Yu, Jialun Zhong, Lei Zou2026-08-04
💬 NLP

Exemplars in Disguise: Pure Exemplar Models Mimic Abstraction-First Learning

تتحدى هذه الورقة البحثية الادعاء بأن النماذج اللغوية الكبيرة تتعلم المعرفة التجريدية قبل التفاصيل الخاصة بكل عنصر، وذلك من خلال إثبات أن نماذج الحفظ الصرف يمكنها محاكاة أنماط التعلم هذه اعتماداً على توزيع المدخلات، مما يشير إلى أن التمييز بين المعرفة الخاصة بالعنصر والمعرفة التجريدية قد يكون غير محدد بدقة بالنسبة للتمثيلات الموزعة.

Zachary Nicholas Houghton, Vsevolod Kapatsinski2026-08-04
💬 NLP

Pruned BPE: Post-training Visibility Pruning and Token Reallocation for Byte Pair Encoding

تقدم هذه الورقة البحثية "Pruned BPE"، وهي طريقة لما بعد التدريب تعمل على تحسين كفاءة التجزئة (tokenization) عن طريق إخفاء رموز الدمج الوسيطة ذات التعرض المنخفض من مفردات النموذج وإعادة تخصيص تلك الحيز للمرشحين الأكثر تكراراً، مما يؤدي إلى تقليل طول التسلسل المشفر دون زيادة حجم المفردات المرئية للنموذج.

Kenny Shao2026-08-04
💬 NLP

Practical Online KV Cache Compaction for LLM Agents: An Empirical Study

تُظهر هذه الدراسة التجريبية أن عملية ضغط ذاكرة التخزين المؤقت لمفاتيح القيم (KV cache) العملية عبر الإنترنت لوكلاء النماذج اللغوية الكبيرة (LLM agents) يمكن أن تحقق تقليلاً كبيراً في الذاكرة ومكاسب في معدل الإنتاجية من خلال تأخير عملية الضغط حتى تتوفر استعلامات الوكيل المستقبلية واستخدام طرد الرموز (token eviction) مع مصادر وكيلة قوية، بدلاً من الاعتماد على افتراضات السياق الفورية أو الثابتة.

Yujian Liu, Jiabao Ji, Li An, Rohit Jain, Gungor Polatkan, Siyu Zhu, Shiyu Chang2026-08-04