🤖 AI

From Generalist to Specialist: A Context-Fusion Framework for Endoscopic Polyp Reporting with a Frozen VLM

تقترح هذه الورقة إطار عمل خفيف الوزن لدمج السياق يعمل على تخصيص نموذج رؤية ولغة عام للأغراض مجمّد عبر الجمع بين رموز المتخصص الضمنية والأدلة الصريحة القائمة على الاسترجاع، محققاً أداءً فائقاً بأقل عدد من المعلمات القابلة للتدريب مقارنة بطرق التكيف الحالية.

Ruijie Yang, Yan Zhu, Peiyao Fu, Siyuan Li, Te Luo, Zhihua Wang, Quanlin Li, Pinghong Zhou, Xian Yang, Shuo Wang2026-08-18
🤖 AI

When Entropy Is Not Enough: Reclaiming Lost Semantics in LLM Output Length Prediction

تقدم هذه الورقة إطار عمل ESTP، وهو إطار عمل خفيف الوزن يعمل على تحسين التنبؤ بطول مخرجات النماذج اللغوية الكبيرة (LLM) من خلال الجمع بين اعتلاج الرموز (token entropy) ودرجات الأهمية الدلالية القائمة على الانتباه، لتمكين جدولة أكثر كفاءة ومدركة للطول وتقليل العبء الحسابي.

Feiyang Ren, Shengtao Wen, Lingbing Guo, Yu Tian, Yuanning Cui, Xiang Chen2026-08-18
🤖 AI

VARM-Bench: Benchmarking Verifiable Structured Reasoning in Chinese Abusive Speech Moderation

تقدم هذه الورقة VARM-Bench، وهو معيار مرجعي جديد مصمم لتقييم الاستدلال الهيكلي القابل للتحقق للإشراف على خطاب الإساءة الصيني من خلال مطالبة النماذج بتوليد مبررات مرتكزة على الحقول لستة قرارات رئيسية، مما يكشف أن الأداء القوي على مستوى الملصقات غالباً ما يخفي أخطاءً جسيمة في سجلات الإشراف الكاملة.

Mingyu Yuan, Shengtao Wen, Lingbing Guo, Zhen Bi, Xiang Chen2026-08-18
🤖 machine learning

FluxBin: Flexible LUT-based Ultra-low-bit LLM Inference by Algorithm-Kernel Synergy

إن FluxBin هو إطار عمل لتصميم مشترك بين الخوارزمية والنواة يجمع بين طريقة مبتكرة لتفكيك الثنائيات المنفصلة ونواة CUDA متخصصة باستخدام جداول البحث والتعيين العمودي الافتراضي لتمكين استنتاج النماذج اللغوية الكبيرة (LLM) بدقة بتّية فائقة الانخفاض مع تحقيق تسريع كبير في السرعة، وتوفير في الطاقة، وتقليل في الذاكرة مع الحفاظ على دقة عالية.

Qingyao Yang, Runming Yang, He Xiao, Wendong Xu, Junyu Chen, Haobo Liu, Chenchen Ding, Ruihan Hu, Yik-Chung Wu, Ngai Won (…)2026-08-18
🤖 AI

EgoGazeLite: On-Device Egocentric Gaze Prediction for Token-Efficient Multimodal LLM Video Input

يُعد EgoGazeLite متنبئاً خفيف الوزن لتتبع نظرات العين ثنائي المعالجة يعمل على الأجهزة، مما يتيح فهماً لـفيديوهات منظور الشخص الأول بكفاءة عالية في استخدام الرموز (tokens) للنماذج اللغوية الكبيرة متعددة الوسائط من خلال قص الفيديو بدقة بناءً على النظرة المتوقعة، مما يلغي الحاجة إلى أجهزة مخصصة لتتبع حركة العين مع الحفاظ على جودة الوصف والعمل في الوقت الفعلي على الأجهزة الاستهلاكية.

Matteo Stoiber, Niels Buus Lassen2026-08-18
🤖 AI

Rotation-Invariant Multi-IMU Activity Recognition under Independent Per-Location Orientation Shifts

تقدم هذه الورقة البحثية TRI-HAR، وهو إطار عمل غير متأثر بالدوران يضمن هيكلياً المتانة تجاه تغيرات توجه وحدة القياس بالقصور الذاتي (IMU) المستقلة لكل موقع في التعرف على الأنشطة البشرية متعددة المستشعرات، وذلك من خلال توظيف عمود فقري متماثل مع مجموعة دوران (SO(3)) ودمج ميزات غير متغير، مما يتفوق على الطرق التقليدية القائمة على تعزيز الدوران دون الحاجة إلى معايرة صريحة أو تعزيز.

Seungyeol Baek, Yoonbyung Chai, Yonghyeon Lee, Sungjoon Choi, Sungho Suh2026-08-18
🤖 AI

Argumentation for Common Ground: Finding Zones of Possible Agreement between Individuals in Conflict

تقترح هذه الورقة إطاراً حجاجياً حوسبياً ينمذج الاستدلال الذاتي للمواطنين حول اتفاقيات السلام لتحديد منطقة اتفاق محتملة (ZOPA) مقبولة متبادلاً، مُثبتةً فاعليتها من خلال التحليل النظري والتجارب على الصراع الفلسطيني الإسرائيلي.

Elisa Cavatorta, Antonio Rago2026-08-18
🤖 AI

Hierarchical Adaptive Feature Refinement Network for VHR Remote Sensing Image Segmentation

تقترح الورقة البحثية شبكة HAFR-Net، وهي شبكة هرمية لتكييف صقل الميزات تعمل على تعزيز تقسيم صور الاستشعار عن بعد عالية الدقة (VHR) من خلال توظيف الاندماج الموجه بالتباين، ومهايئات البقايا الترددية، والبديهيات المدركة للارتباك لصقل التمثيلات الهرمية سابقة التدريب تدريجيًا، مما يحقق أداءً هو الأفضل في فئته عبر معايير متعددة.

Shuaishuai Cao, Meng Tang, Shuwei Peng, Xuan Liu, Min Huang, Jie Chen, Jiacheng Niu, Yong Chen, Edore Akpokodje, Hui Lin2026-08-18
🤖 AI

A Responsible Artificial Intelligence Framework for Groundwater Modeling

تقترح هذه الورقة إطار عمل للذكاء الاصطناعي المسؤول يتكون من ستة مبادئ أخلاقية، وتستعرض تطبيقها العملي في نمذجة المياه الجوفية داخل حوض نهر هيهي، حيث تفوقت نماذج "ترانسفورمر" (Transformer) على نماذج "إل إس تي إم" (LSTM) من حيث الدقة والمتانة والقابلية للتفسير لدعم الإدارة المستدامة للمياه.

Chong Chen, Yulu Zhang, Qingxi Guo, Yihan Liu2026-08-18
🤖 machine learning

PL-Guard: Probabilistic Logic Reasoning for LLM Guardrails

تُعد PL-Guard بنية حماية عصبية رمزية تفصل بين التأسيس الدلالي والاستدلال السياساتي عبر استخدام نموذج لغوي كبير محلي لاستخراج احتمالات المحمولات وProbLog للاستدلال الاحتمالي الصريح، مما يقلل بشكل كبير من الامتثال غير الآمن في اختبار XSTest مع زيادة معدلات الرفض المفرط.

Satchit Chatterji, Shihan Wang, Giovanni Sileno, Erman Acar2026-08-18