🤖 AI

PixelPrune: Pixel-Level Adaptive Visual Token Reduction via Predictive Coding

تُعد PixelPrune طريقةً لتقليل الرموز (tokens) على مستوى البكسل وتكيفيةً ولا تتطلب تدريباً، حيث تستفيد من الترميز التنبؤي لإزالة رقع الصور الزائدة قبل مُشفر المحول الرؤيوي (Vision Transformer)، مما يسرع بشكل كبير عمليات التدريب والاستدلال لنماذج الرؤية واللغة مع الحفاظ على دقة تنافسية في اختبارات قياس المستندات وواجهات المستخدم الرسومية (GUI).

Nan Wang, Zhiwei Jin, Chen Chen, Haonan Lu2026-04-02
📊 statistics

Phase transition on a context-sensitive random language model with short range interactions

تُظهر هذه الدراسة أن التحولات الطورية عند درجات الحرارة المحدودة في نماذج اللغة العشوائية تنشأ من الطبيعة الجوهرية لقواعد النحو الحساسة للسياق ذات التفاعلات قصيرة المدى، وليس اعتمادها حصراً على التفاعلات طويلة المدى.

Yuma Toji, Jun Takahashi, Vwani Roychowdhury, Hideyuki Miyahara2026-04-02
🤖 AI

Do Phone-Use Agents Respect Your Privacy?

تقدم هذه الورقة MyPhoneBench، وهو إطار عمل قابل للتحقق لتقييم السلوك المعتمد على احترام الخصوصية في وكلاء استخدام الهاتف، كاشفةً أنه بينما تستطيع النماذج الحالية إكمال المهام، إلا أنها تفشل تكراراً في تقليل الإفصاح عن البيانات بسبب التنفيذ المفرط في المساعدة، مما يسلط الضضوء على الحاجة إلى مقاييس مشتركة للخصوصية والنجاح لتقييم جاهزية النشر بدقة.

Zhengyang Tang, Ke Ji, Xidong Wang, Zihan Ye, Xinyuan Wang, Yiduo Guo, Ziniu Li, Chenxin Li, Jingyuan Hu, Shunian Chen (…)2026-04-02
🤖 AI

Multimodal Analysis of State-Funded News Coverage of the Israel-Hamas War on YouTube Shorts

تقدم هذه الورقة البحثية مساراً متعدد الوسائط يجمع بين النسخ التلقائي، وتحليل المشاعر القائم على الجوانب، وتصنيف المشهد الدلالي لتحليل أكثر من 2,300 مقطع من فيديوهات "YouTube Shorts" الممولة من الدولة والتي تغطي الحرب بين إسرائيل وحماس، مما يكشف عن أنماط مشاعر متميزة عبر مختلف المنافذ الإعلامية ويثبت أن النماذج المكيّفة للمجال والموفرة للموارد يمكن أن تتفوق على نماذج "ترانسفورمرز" الضخمة في هذا السياق البحثي المحدد.

Daniel Miehling, Sandra Kuebler2026-04-02
🤖 AI

Brainstacks: Cross-Domain Cognitive Capabilities via Frozen MoE-LoRA Stacks for Continual LLM Learning

تُعد "براتس تيكس" (Brainstacks) بنية تعلم مستمر معيارية تجمع بين مجموعات (MoE-LoRA) المجمدة وإسقاط الفضاء الصفري وموجه ميتا قائم على النتائج لتحقيق انعدام النسيان، والتركيب عبر المجالات، واكتشاف الأوليات المعرفية القابلة للنقل في النماذج اللغوية الكبيرة.

Mohammad R. Abu Ayyash2026-04-02
🤖 machine learning

S0 Tuning: Zero-Overhead Adaptation of Hybrid Recurrent-Attention Models

يُعد S0 tuning طريقةً لضبط المعلمات بكفاءة عالية وبدون أعباء إضافية للنماذج الهجينة التي تجمع بين التكرار والانتباه، حيث تعمل على تحسين مصفوفة حالة أولية واحدة لكل طبقة باستخدام حد أدنى من الإشراف الموثق، محققةً مكاسب في الأداء تضاهي أو تتجاوز تقنية LoRA دون الحاجة إلى دمج الأوزان أو التسبب في تأخير عند الاستنتاج.

Jack Young2026-04-02
📊 statistics

Online Reasoning Calibration: Test-Time Training Enables Generalizable Conformal LLM Reasoning

تقدم الورقة البحثية إطار عمل "معايرة الاستدلال عبر الإنترنت" (ORCA)، وهو إطار يجمع بين التنبؤ المطابق والتدريب أثناء الاختبار لمعايرة أخذ عينات النماذج اللغوية الكبيرة ديناميكيًا، مما يؤدي إلى تحسين كفاءة الحوسبة والتعميم بشكل كبير عبر مهام الاستدلال داخل النطاق وخارجه مع الحفاظ على ضمانات المخاطر النظرية.

Cai Zhou, Zekai Wang, Menghua Wu, Qianyu Julie Zhu, Flora C. Shi, Chenyu Wang, Ashia Wilson, Tommi Jaakkola, Stephen Bat (…)2026-04-02
🤖 machine learning

Screening Is Enough

تقدم الورقة البحثية "Multiscreen"، وهي بنية نموذج لغوي مبتكرة تستبدل آلية انتباه "softmax" القياسية بآلية فحص قائمة على العتبة لتمكين الصلة المطلقة بين الاستعلام والمفتاح، مما ينتج عنه نموذج يحقق أداءً مماثلاً بعدد أقل من المعلمات، ويدعم معدلات تعلم أكبر، ويحافظ على قدرات السياق الطويل، ويقلل زمن انتقال الاستدلال بشكل كبير.

Ken M. Nakanishi2026-04-02
🤖 machine learning

LLM REgression with a Latent Iterative State Head

تُعد RELISH بنية خفيفة الوزن وفعالة من حيث عدد المعلمات، وتتفوق على الأساليب الحالية في مهام الانحدار النصي من خلال التنبؤ بالقيم القياسية مباشرة من تمثيلات النماذج اللغوية الكبيرة المجمدة عبر عملية تكرارية لصقل الحالة الكامنة، مما يتطلب جزءاً ضئيلاً فقط من المعلمات الإضافية القابلة للتدريب.

Yiheng Su, Matthew Lease2026-04-02
🤖 AI

YC-Bench\texttt{YC-Bench}: Benchmarking AI Agents for Long-Term Planning and Consistent Execution

تقدم الورقة البحثية YC-Bench\texttt{YC-Bench}، وهو معيار مفتوح المصدر يقيم قدرات التخطيط والتنفيذ طويلة المدى لدى وكلاء الذكاء الاصطناعي من خلال تحدي شركة ناشئة محاكى لمدة عام واحد، كاشفةً أنه في حين لم تحقق سوى نماذج رائدة قليلة الربحية، فإن النجاح يعتمد بشكل كبير على استخدام "المسودة" (scratchpad) لاستمرارية السياق والقدرة على اكتشاف العملاء العدائيين.

Muyu He, Adit Jain, Anand Kumar, Vincent Tu, Soumyadeep Bakshi, Sachin Patro, Nazneen Rajani2026-04-02