💻 computer science

DeMTS: Denoising Trajectories as Multivariate Time Series for Hallucination Detection in Diffusion Language Models

تقترح الورقة البحثية DeMTS، وهو إطار عمل جديد للكشف عن الهلوسة في النماذج اللغوية الكبيرة القائمة على الانتشار (Diffusion Large Language Models)، والذي يعامل مسارات إزالة الضجيج (denoising trajectories) كسلاسل زمنية متعددة المتغيرات للحفاظ على المعلومات الهيكلية الكاملة لخطوات الرموز (token-step structural information)، مما يتفوق على الأساليب الحالية من خلال التقاط الأنماط المعقدة بفعالية مثل التقارب غير المتسق وانتشار الخطأ عبر الرموز (cross-token fault propagation).

Xin Zhang, Yili Wang, Yue Tan, Xin He, Yanyu Qian, Yixin Liu, Yi Chang, Shirui Pan, Xin Wang2026-08-18
🤖 machine learning

Valid Per-Field Selective Risk Control for Document Extraction: Three Failure Modes, a Validity Ladder, and When Conditioning Pays

تشخص هذه الورقة ثلاثة أنماط فشل حرجة تتسبب في جعل التحكم الانتقائي في المخاطر لكل حقل على حدة في استخراج المستندات ينتهك ضمانات السلامة، وتقترح "سلم صلاحية" من الإصلاحات المتزايدة الصرامة — بما في ذلك تعلم "موندريان" ثم الاختبار وتصنيف صناديق الدعم — والتي تثبت في النهاية كيف يمكن أن يؤدي التكييف على المصدر في تحقيق تحكم صالح في المخاطر حيث تفشل العتبات المجمعة، وهو اكتشاف تم التحقق منه من خلال عمليات التدقيق البشري وإصداره كبرمجيات مفتوحة المصدر.

Bhaskar Gurram2026-08-18
🤖 machine learning

DUET: Dual-Teacher On-Policy Distillation via Same-Weight Disagreement for Prohibition Compliance

تقترح الورقة البحثية DUET، وهي طريقة تقطير داخل السياسة قائمة على اختيار الرموز (token-selective) تستفيد من عدم الاتفاق لكل رمز بين معلمين متماثلي الأوزان (أحدهما مع سياق الحظر والآخر بدونه) لتوليد إشارة إشراف نظيفة لتدريب النماذج على الامتثال للمحظورات الديناميكية الخاصة بكل طلب مع الحفاظ على المنفعة العامة.

Zihan Li, Feifei Li, Wenhui Que2026-08-18
🤖 machine learning

pico-type: A 1.5M-Parameter Byte-Level Multi-Head Content Classifier

تقدم الورقة البحثية pico-type، وهو مصنف متعدد الرؤوس على مستوى البايت خفيف الوزن بـ 1.5 مليون معلمة، يتنبأ في آن واحد بسبعة خصائص للمحتوى (بما في ذلك اللغة، ونوع MIME، وعلامات المخاطر) من بايتات UTF-8 الخام في أقل من 10 مللي ثانية دون الحاجة إلى عملية التجزئة (tokenization)، محققاً تحسينات كبيرة في الدقة مقارنة بالنماذج الاصطناعية المرجعية على مجموعات بيانات واقعية.

Gautam Kishore2026-08-18
💻 computer science

Automatic or Controlled? Repetition Priming Reveals Divergent Processing in Base LLMs, Instruct LLMs, and Humans

تكشف هذه الدراسة أنه بينما تعالج نماذج اللغة الأساسية الكلمات المتكررة من خلال تسهيل تلقائي ومستقر، فإن التدريب اللاحق لتحويلها إلى نماذج إرشادية ينقلها نحو معالجة محكومة وحساسة للتأخير تختلف عن الإدراك البشري، الذي يُظهر ملفاً تعريفياً هجيناً من التسهيل الحساس للتأخير دون تداخل.

Jinglei Ren, Yuyue Wang2026-08-18
💻 computer science

Domain Agnostic Text Redaction from Natural Language Rules using Instruction Tuning

تقدم هذه الورقة إطار عمل لتنقيح النصوص يتميز بالقدرة على التفسير وعدم الارتباط بمجال محدد، حيث يستفيد من النماذج اللغوية الضبطية (instruction-tuned) لتحديد المعلومات الحساسة وتنقيحها بناءً على قواعد لغوية طبيعية يحددها المستخدم، مما يوفر مبررات شفافة لكل إجراء لضمان القابلية للتدقيق والدقة العالية في التطبيقات الحرجة مثل الوثائق القانونية والطبية.

Aravindhan Arunagiri, Ayaan Khan, Udayaadithya Avadhanam, SaiBarath Sundar2026-08-18
💻 computer science

Path2ST: Hierarchical Cell-Tissue Grounded Cross-Modal Translation for Spatial Transcriptomics

يُعد Path2ST إطار عمل هرمي مبتكر يعمل على تحسين التنبؤ بالتعبير الجيني المكاني من الصور المصبوغة بصبغة الهيماتوكسيلين والإيوسين (H&E) عبر الاستفادة من التسلسلات الهرمية البيولوجية المتأصلة بين الخلايا والأنسجة من خلال نهج ترجمة دلالية متعدد الوسائط، محققاً أداءً هو الأفضل في حالته في توليد ملفات تعريف ترانسكريبتومية دقيقة ومتماسكة مكانياً.

Ruochen Liu, Wei Lou2026-08-18
📊 statistics

Which Question Is Your Attention Metric Answering? Attention Rows as Compositional Data

تجادل هذه الورقة بأن مقاييس الانتباه القياسية غالبًا ما تؤدي إلى استنتاجات مضللة لأنها تفشل في التمييز بين تركيز النموذج على رمز "بالوعة" (sink token) مهيمن وتوزيعه على رموز المحتوى، وتقترح بدلاً من ذلك معاملة صفوف الانتباه كبيانات تركيبية لفصل هذه العوامل بدقة وتجنب العيوب في تحليل النماذج وتقليصها.

Marios Papamichalis, Regina Ruane2026-08-18
💻 computer science

VideoGAIA: A Benchmark for General AI Assistants on Agentic Video Understanding

لمعالجة تشبع معايير فهم الفيديو التقليدية أحادية الدور، تقدم هذه الورقة VideoGAIA، وهو معيار صارم متعدد الأدوار ومعزز بالأدوات يضم 271 مهمة تم التحقق منها من قبل خبراء، والتي تكشف عن فجوات كبيرة في أداء النماذج اللغوية الكبيرة متعددة الوسائط الرائدة حالياً، وتهدف إلى دفع المجال نحو فهم الفيديو القائم على الوكالة.

Fan Zhang, Guangming Yao, Jinyang Wu, Hao Wu, Zheng Lian, Xinyu Geng, Jingdong Chen, Yi Yuan, Pheng-Ann Heng2026-08-18
💻 computer science

NARRATE: A Multimodal Real-World Australian Driving Dataset for Human-Centred Explanations in Automated Driving

تقدم الورقة البحثية NARRATE، وهي مجموعة بيانات قيادة أسترالية واقعية متعددة الوسائط تضم 2,050 حدثاً مشروحة ببيانات مستشعرات متزامنة وتفسيرات أنشأها السائقون، وذلك بهدف تطوير نماذج للقيادة الذاتية تتمحور حول الإنسان وتراعي المجال المعرفي.

Ashkan Yousefi Zadeh, Zishuo Zhu, Xiaomeng Li, Andry Rakotonirainy, Sebastien Glaser, Ronald Schroeter, Patricia Delhomm (…)2026-08-18