🤖 AI

Is Your LLM Overcharging You? Tokenization, Transparency, and Incentives

تكشف هذه الورقة أن نموذج تسعير الدفع مقابل كل رمز (token) الحالي للنماذج اللغوية الكبيرة يخلق حافزاً مالياً للمزودين للإبلاغ الخاطئ عن أعداد الرموز وتحصيل رسوم زائدة من المستخدمين، وهي ثغرة تستمر حتى مع وجود متطلبات الشفافية ولكن يمكن التخفيف من حدتها عبر اعتماد آلية تسعير قائمة على عدد الحروف تظل مربحة للمزودين.

Ander Artola Velasco, Stratis Tsirtsis, Nastaran Okati, Manuel Gomez-Rodriguez2026-05-29
🤖 AI

EPiC: Efficient Video Camera Control Learning with Precise Anchor-Video Guidance

يُعد EPiC إطار عمل فعال للتحكم في الكاميرا يلغي الحاجة إلى تقدير السحابة النقطية والوضعية المعرضين للخطأ من خلال إنشاء فيديوهات مرجعية دقيقة عبر قناع رؤية الإطار الأول، مما يتيح توليد فيديو موجه بالكاميرا يتسم بالمتانة وخفة المعلمات مع أداء يضاهي أحدث المستويات التقنية.

Zun Wang, Jaemin Cho, Jialu Li, Han Lin, Jaehong Yoon, Yue Zhang, Mohit Bansal2026-05-29
🤖 AI

PersonaAgent: Bridging Memory and Action for Personalized LLM Agents

تقدم الورقة البحثية PersonaAgent، وهو إطار عمل مبتكر يعزز وكلاء النماذج اللغوية الكبيرة من خلال دمج وحدات ذاكرة وأفعال مخصصة موجهة بشخصيات مستخدمين ديناميكية، مما يحقق توافقاً فائقاً مع التفضيلات في الوقت الفعلي وأداءً مصمماً خصيصاً عبر استراتيجية تحسين في وقت الاختبار.

Weizhi Zhang, Xinyang Zhang, Chenwei Zhang, Liangwei Yang, Jingbo Shang, Zhepei Wei, Henry Peng Zou, Zijie Huang, Zhengy (…)2026-05-29
🤖 AI

Position: Text Embeddings Should Capture Implicit Semantics, Not Just Surface Meaning

تجادل هذه الورقة الموقفية بأن أبحاث تضمين النصوص يجب أن تحول تركيزها من الدلالات السطحية إلى التقاط المعاني الضمنية — مثل التداولية وقصد المتحدث — من خلال اعتماد بيانات قائمة على أسس لغوية، ومعايير تقييم أكثر عمقاً، وهدف نمذجة جوهري يعكس بشكل أفضل تعقيد اللغة في العالم الحقيقي.

Yiqun Sun, Qiang Huang, Anthony K. H. Tung, Jun Yu2026-05-29
🤖 machine learning

Model Fusion via Retrofitting

تقدم هذه الورقة إطار عمل لدمج النماذج متمحور حول العصبونات، يعامل الدمج كمسألة مطابقة تمثيل من خلال تجميع العصبونات الوسيطة واستخدام درجات الإسناد لمحاذاة الميزات البارزة، محققاً أداءً فائقاً على الطرق الحالية — لا سيما في سيناريوهات التعلم الصفري (zero-shot) والبيانات غير المتماثلة (non-IID) — عبر بنيات متنوعة مثل VGGs وResNets وViTs دون الحاجة لإعادة التدريب.

Phoomraphee Luenam, Andreas Spanopoulos, Amit Sant, Thomas Hofmann, Sotiris Anagnostidis, Sidak Pal Singh2026-05-29
🤖 AI

Structure-Aware Compound-Protein Affinity Prediction via Graph Neural Network with Group Lasso Regularization

تقترح هذه الورقة إطار عمل للشبكات العصبية الرسومية القابلة للتفسير، المعززة بتنظيمات "لازو المجموعات" (group lasso) و"لازو المجموعات المتناثرة" (sparse group lasso) للتنبؤ بالألفة بين المركب والبروتين من خلال الاستفادة من أزواج المنحدرات النشطة، مما يؤدي إلى تحسين دقة التنبؤ وتحديد البنى الجزيئية الفرعية الحرجة لاكتشاف الأدوية.

Zanyu Shi, Yang Wang, Pathum Weerawarna, Jie Zhang, Timothy Richardson, Yijie Wang, Kun Huang2026-05-29
🤖 AI

Taming Data Challenges in ML-based Security Tasks Using Generative AI

تُثبت هذه الورقة أن تعزيز مجموعات بيانات التدريب ببيانات اصطناعية ناتجة عن الذكاء الاصطناعي التوليدي، بما في ذلك طريقة مبتكرة تسمى "نيماي" (Nimai)، يمكن أن يحسن بشكل كبير من أداء وقدرة التصنيفات الأمنية القائمة على التعلم الآلي على التكيف، لا سي fact في البيئات محدودة البيانات، مع تحديد خصائص معينة للبيانات قد تعيق مثل هذه التحسينات.

Shravya Kanchi, Neal Mangaokar, Aravind Cheruvu, Sifat Muhammad Abdullah, Shirin Nilizadeh, Atul Prakash, Bimal Viswanat (…)2026-05-29
🤖 AI

GroundAct: Can LLM Agents Ground Actions in Environmental States?

تقدم الورقة البحثية GroundAct، وهو معيار شامل يوضح أن وكلاء النماذج اللغوية الكبيرة (LLM) يواجهون صعوبة في ربط الأفعال بالحالات البيئية عندما تغفل التعليمات تفاصيل الجدوى، مما يكشف أن هذا التحدي متعدد الأبعاد لا يمكن حله بمجرد التوسع وحده، بل يتطلب قدرات محددة في الاستدلال على السمات، والأدوات، والتنسيق.

Zixuan Wang, Dingming Li, Hongxing Li, Yanrui Miao, Shuo Chen, Yuchen Yan, Wenqi Zhang, Yongliang Shen, Weiming Lu, Jun (…)2026-05-29
⚡ electrical engineering

Scalable RF Simulation in Generative 4D Worlds

يقدم البحث WaveVerse، وهو إطار عمل قابل للتوسع وقائم على الأوامر النصية يجمع بين مولد عالم رباعي الأبعاد موجه لغوياً ومتتبع أشعة متماسك الطور لمحاكاة إشارات الترددات الراديوية عالية الدقة في البيئات الداخلية الديناميكية، مما يتغلب على ندرة البيانات ويحسن مهام إدراك الترددات الراديوية في المراحل اللاحقة بشكل كبير.

Zhiwei Zheng, Dongyin Hu, Mingmin Zhao2026-05-29
🤖 AI

PuzzleClone: A DSL-Powered Framework for Synthesizing Verifiable Data

تقدم الورقة البحثية PuzzleClone، وهو إطار عمل مدعوم بلغة وصفية مخصصة (DSL) يقوم بتوليف أكثر من 83,000 لغز منطقي متنوع وقابل للتحقق لتعزيز قدرات الاستنتاج لدى النماذج اللغوية الكبيرة، مما أظهر مكاسب ملحوظة في الأداء عبر العديد من الاختبارات المرجعية الرياضية والمنطقية بعد مرحلة ما بعد التدريب.

Kai Xiong, Yanwei Huang, Rongjunchen Zhang, Kun Chen, Haipang Wu, Yingcai Wu2026-05-29