💬 NLP

Logic-Regularized Verifier Elicits Reasoning from LLMs

تقدم الورقة البحثية LOVER، وهو مُحقِّق غير مُشرف يستفيد من القيود المنطقية على مسارات الاستدلال لاستخراج استدلال قوي من النماذج اللغوية الكبيرة الجاهزة دون الحاجة إلى بيانات مُشرفة مكلفة، محققاً أداءً يضاهي النماذج المرجعية المُشرفة.

Xinyu Wang, Changzhi Sun, Lian Cheng, Yuanbin Wu, Dell Zhang, Xiaoling Wang, Xuelong Li2026-05-08
💬 NLP

Minimizing Modality Gap from the Input Side: Your Speech LLM Can Be a Prosody-Aware Text LLM

تقترح الورقة البحثية TextPro-SLM، وهو نموذج لغوي كبير للكلام يقلل من الفجوة بين الأنماط من خلال معالجة المدخلات الصوتية عبر مشفر موحد يعمل على محاذاة رموز النصوص مع تضمينات العروض (prosody embeddings)، مما يمكّن النموذج من العمل كنموذج لغوي كبير للنصوص مدرك للعروض ويمتلك فهماً قوياً للسمات شبه اللغوية باستخدام 1,000 ساعة فقط من بيانات التدريب.

Wenqian Cui, Xiao-Hui Li, Daxin Tan, Qiyong Zheng, Irwin King2026-05-08
🤖 machine learning

Near-Policy: Accelerating On-Policy Distillation via Asynchronous Generation and Selective Packing

تقترح الورقة البحثية تقنية تقطير السياسة القريبة (NPD)، وهي إطار عمل غير متزامن يعمل على تسريع تقطير المعرفة القائم على السياسة من خلال فصل عملية التوليد عن التدريب واستخدام تصفية Δ\Delta-IFD للتخفيف من تأخيرات السياسة، مما يحقق تسريعاً بمقدار 8.1 ضعفاً وأداءً فائقاً مقارنة بالضبط الدقيق للتعلم الخاضع للإشراف (SFT) القياسي والنماذج الأكبر حجماً.

Miao Rang, Zhenni Bi, Hang Zhou, Kai Han, Xuechun Wang, An Xiao, Xinghao Chen, Yunhe Wang, Hanting Chen2026-05-08
💬 NLP

MobileEgo Anywhere: Open Infrastructure for long horizon egocentric data on commodity hardware

تقدم هذه الورقة MobileEgo Anywhere، وهو إطار عمل يستفيد من الهواتف الذكية الشائعة لتعميم جمع مجموعات بيانات منظور الشخص الأول واسعة النطاق ومدتها ساعة كاملة مع تتبع الحالة المستمر، مما يعالج ندرة البيانات طويلة المدى اللازمة لتطوير نماذج الرؤية واللغة والعمل (Vision Language Action models).

Senthil Palanisamy, Abhishek Anand, Satpal Singh Rathor, Pratyush Patnaik, Shubhanshu Khatana2026-05-08
💬 NLP

Hallucination as an Anomaly: Dynamic Intervention via Probabilistic Circuits

تقدم الورقة البحثية PCNET، وهي طريقة قائمة على الدوائر الاحتمالية تكتشف الهلوسة كشذوذ هندسي في التدفق المتبقي للنموذج اللغوي الكبير لتمكين التدخل الديناميكي المستهدف عبر PC-LDCD، مما يقلل من الهلوسة بشكل كبير مع الحفاظ على سلامة التوليدات الصحيحة دون الحاجة إلى تعديل أوزان النموذج أو استخدام أدوات تحقق خارجية.

Erik Nielsen, Elia Cunegatti, Marcus Vukojevic, Giovanni Iacca2026-05-08
💬 NLP

TheraAgent: Self-Improving Therapeutic Agent for Precise and Comprehensive Treatment Planning

يُعد TheraAgent إطار عمل وكيلِيّاً ذاتي التحسين يعمل على تعزيز تخطيط العلاج عبر استبدال التوليد لمرة واحدة بواسطة النماذج اللغوية الكبيرة بمسار تكراري من (التوليد-التحكيم-التحسين)، مستخدماً وحدة TheraJudge متخصصة لتحقيق مستويات رائدة في الدقة والاكتمال والسلامة تتجاوز أطباء بشريين في التقييمات الخبيرة.

Junkai Li, Yunghwei Lai, Tianyi Zhu, Zheng Long Lee, Weizhi Ma, Yang Liu2026-05-08
💬 NLP

Safety Anchor: Defending Harmful Fine-tuning via Geometric Bottlenecks

تقترح هذه الورقة "تنظيم عنق زجاجة السلامة" (SBR)، وهو آلية دفاعية مبتكرة تعمل على تثبيت طبقة فك التشفيد (unembedding layer) بنماذج متوافقة مع معايير السلامة، مما يؤدي بفعالية إلى تحييد هجمات الضبط الدقيق الضارة من خلال استغلال العنق الزجاجي الهندسي للحفاظ على السلامة دون المساس بأداء المهام الحميدة.

Guoxin Lu, Letian Sha, Qing Wang, Peijie Sun, Hao Zhou, Hua Dai, Fu Xiao2026-05-08
💬 NLP

PersonaKit (PK): A Plug-and-Play Platform for User Testing Diverse Roles in Full-Duplex Dialogue

تُعد PersonaKit منصة ويب مفتوحة المصدر ومنخفضة زمن الاستجابة، تُمكّن الباحثين من النمذجة الأولية السريعة وتقييم استراتيجيات متنوعة لتبادل الأدوار الخاصة بالشخصيات في أنظمة الحوار الصوتي ثنائية الاتجاه (full-duplex) من خلال إعدادات JSON بديهية واختبارات A/B مؤتمتة.

Hyunbae Jeon, Jinho D. Choi2026-05-08
💬 NLP

More Aligned, Less Diverse? Analyzing the Grammar and Lexicon of Two Generations of LLMs

تقارن هذه الدراسة بين جيلين من النماذج اللغوية الكبيرة مقابل النصوص الإخبارية التي كتبها بشر باستخدام صيغة HPSG ومقاييس التنوع، مما يكشف أنه بينما تظل الكتابة البشرية مستقرة، تُظهر النماذج الأحدث المضبوطة للتعليمات انخفاضاً ملحوظاً في التنوع التركيبي والمعجمي، مما يشير إلى احتمال ضيق النطاق التعبيري رغم تحسن التماسك.

Adrián Gude, Roi Santos-Ríos, Francis Bond, Dan Flickinger, Carlos Gómez-Rodríguez, Olga Zamaraeva2026-05-08
💬 NLP

Novelty-based Tree-of-Thought Search for LLM Reasoning and Planning

تقدم هذه الورقة طريقة بحث قائمة على الجدة تعتمد على "شجرة الأفكار" (Tree-of-Thought)، والتي تستفيد من المعرفة المسبقة للنماذج اللغوية الكبيرة (LLM) لقياس وتقليم مسارات الاستدلال الزائدة، مما يؤدي إلى تحسين الكفاءة وتقليل تكاليف الرموز (tokens) في مهام التخطيط والاستدلال القائمة على اللغة.

Leon Hamm, Zlatan Ajanovic2026-05-08