💬 NLP

PASK: Toward Intent-Aware Proactive Agents with Long-Term Memory

تقدم هذه الورقة نظام PASK، وهو نظام وكيل استباقي يتميز بنموذج DD-MM-PAS ومعيار LatentsNeeds-Bench الجديد، والمصمم لاستنتاج احتياجات المستخدم الكامنة وتنفيذ تدخلات في الوقت المناسب في البيئات المعقدة والواقعية من خلال الاستفيادة من كشف النوايا المتدفق والذاكرة الهجينة طويلة الأمد.

Zhifei Xie, Zongzheng Hu, Fangda Ye, Xin Zhang, Haobo Chai, Zihang Liu, Pengcheng Wu, Guibin Zhang, Yue Liao, Xiaobin Hu (…)2026-04-10
💬 NLP

Guaranteeing Knowledge Integration with Joint Decoding for Retrieval-Augmented Generation

تقدم الورقة البحثية إطار عمل "GuarantRAG"، الذي يعزز التوليد المعزز بالاسترجاع (RAG) من خلال فصل الاستدلال عن دمج الأدلة عبر هدف "DPO" التبايني المبتكر وآلية فك ترميز مشتركة، مما يحل بفعالية النزاعات بين المعرفة البارامترية الداخلية والمستندات المسترجعة الخارجية لتحسين الدقة بشكل كبير وتقليل الهلوسة.

Zhengyi Zhao, Shubo Zhang, Zezhong Wang, Yuxi Zhang, Huimin Wang, Yutian Zhao, Yefeng Zheng, Binyang Li, Kam-Fai Wong, X (…)2026-04-10
💬 NLP

Quantum Vision Theory Applied to Audio Classification for Deepfake Speech Detection

تقترح هذه الورقة نظرية الرؤية الكمومية (QV)، وهي إطار عمل مستوحى من ميكانيكا الكم يعمل على تحويل المخططات الطيفية الصوتية إلى موجات معلوماتية لتعزيز نماذج التعلم العميق، مما يثبت أن الشبكات العصبية التلاففية ونماذج المحولات البصرية القائمة على هذه النظرية تتفوق بشكل كبير على البنيات القياسية في كشف التزييف العميق للكلام في مجموعة بيانات ASVSpoof.

Khalid Zaman, Melike Sah, Anuwat Chaiwongyenc, Cem Direkoglu2026-04-10
💬 NLP

Initialisation Determines the Basin: Efficient Codebook Optimisation for Extreme LLM Quantization

تحدد هذه الورقة البحثية تهيئة كتاب الرموز (codebook initialization) باعتبارها العائق الحرج في عملية تكميم النماذج اللغوية الكبيرة (LLM) عند مستوى 2-بت المتطرف، وتقترح طريقة OA-EM، وهي طريقة تهيئة تعتمد على خوارزمية توقع التوقع (EM) المدركة للمخرجات باستخدام مسافة ماهالانوبيس الموزونة بـ "هسيان" (Hessian-weighted Mahalanobis distance)، والتي تتفوق باستمرار على النهج الحالية من خلال وضع النماذج في أحواض تحسين فائقة لعمليات الضبط الدقيق اللاحقة.

Ian W. Kennedy, Nafise Sadat Moosavi2026-04-10
💬 NLP

Small Vision-Language Models are Smart Compressors for Long Video Understanding

تقترح الورقة البحثية Tempo، وهو إطار عمل مدرك للاستعلام يستفيد من نموذج رؤية-لغة صغير كضاغط زمني محلي وموجه تخصيص الرموز التكيفي لتقطير مقاطع الفيديو التي تبلغ مدتها ساعة واحدة بكفاءة إلى تمثيلات مدمجة ومتوافقة مع القصد، محققاً أداءً هو الأفضل في فئته على مقاييس فهم مقاطع الفيديو طويلة المدى مع العمل ضمن ميزانيات رموز صارمة.

Junjie Fei, Jun Chen, Zechun Liu, Yunyang Xiong, Chong Zhou, Wei Wen, Junlin Han, Mingchen Zhuge, Saksham Suri, Qi Qian (…)2026-04-10
💬 NLP

Floating or Suggesting Ideas? A Large-Scale Contrastive Analysis of Metaphorical and Literal Verb-Object Constructions

تحلل هذه الدراسة واسعة النطاق ما يقرب من 300 زوج من (فعل-مفعول به) في اللغة الإنجليزية لتكشف أنه في حين تظهر السياقات الاستعارية عموماً حمولة عاطفية وتنوعاً معجمياً أعلى مقارنة بالسياقات الحرفية، إلا أنه لا يوجد نمط توزيعي واحد ثابت يميز بينهما، حيث إن الاختلافات تعتمد بشكل كبير على تركيبات فردية محددة.

Prisca Piccirilli, Alexander Fraser, Sabine Schulte im Walde2026-04-10
💬 NLP

Can Vision Language Models Judge Action Quality? An Empirical Evaluation

تقدم هذه الورقة تقييماً تجريبياً شاملاً يكشف أن نماذج الرؤية واللغة المتطورة حالياً لا تؤدي إلا بمستوى أعلى قليلاً من الصدفة العشوائية في تقييم جودة الحركة بسبب التحيزات المنهجية والقيود الجوهرية في تحليل الحركة الدقيقة، مما يشير إلى أن هناك حاجة إلى تقدم كبير قبل النشر الموثوق في العالم الحقيقي.

Miguel Monte e Freitas, Rui Henriques, Ricardo Rei, Pedro Henrique Martins2026-04-10
💬 NLP

Towards Real-world Human Behavior Simulation: Benchmarking Large Language Models on Long-horizon, Cross-scenario, Heterogeneous Behavior Traces

تقدم هذه الورقة البحثية OmniBehavior، وهو أول معيار مرجعي تم بناؤه بالكامل من بيانات واقعية لتقييم النماذج اللغوية الكبيرة في السلوك البشري طويل الأمد وعابر السيناريوهات، مما يكشف عن معاناة النماذج الحالية من "رؤية نفقية" وتحيز هيكلي جوهري نحو شخصيات متجانسة وإيجابية بشكل مفرط تفشل في استيعاب الفروق الفردية الحقيقية.

Jiawei Chen, Ruoxi Xu, Boxi Cao, Ruotong Pan, Yunfei Zhang, Yifei Hu, Yong Du, Tingting Gao, Yaojie Lu, Yingfei Sun, Xia (…)2026-04-10
💬 NLP

SOLAR: Communication-Efficient Model Adaptation via Subspace-Oriented Latent Adapter Reparametrization

تقدم الورقة البحثية SOLAR، وهو إطار عمل لضغط ما بعد التدريب غير مرتبط بنموذج محدد يستفيد من المتجهات الفردية للنموذج التأسيسي لإعادة تمثيل محولات الضبط الدقيق الفعالة للمعلمات (PEFT) في تمثيلات مدمجة وفعالة من حيث الاتصال، مما يقلل بشكل كبير من تكاليف التخزين والنقل مع الحفاظ على أداء المهام عبر المهام اللغوية والبصرية.

Seyed Mahmoud Sajjadi Mohammadabadi, Xiaolong Ma, Lei Yang, Feng Yan, Junshan Zhang2026-04-10
💬 NLP

Don't Overthink It: Inter-Rollout Action Agreement as a Free Adaptive-Compute Signal for LLM Agents

تقدم الورقة البحثية TrACE، وهو متحكم لا يتطلب تدريباً يقوم بتخصيص حوسبة وقت الاستدلال ديناميكياً لوكلاء النماذج اللغوية الكبيرة من خلال قياس مدى الاتفاق بين الإجراءات في عمليات المحاكلة، مما يحقق دقة تضاهي طرق الاتساق الذاتي ذات الميزانية الثابتة مع تقليل عدد استدعاءات النماذج اللغوية الكبيرة بشكل كبير في كل من مهام الاستدلال والملاحة.

Khushal Sethi2026-04-10