💬 NLP

AdaThink-Med: Optimizing Inference-Time Compute for Medical Reasoning via Uncertainty Quantification

إن AdaThink-Med هو إطار عمل متكامل يعمل على تحسين الاستنتاج الطبي باستخدام الضبط الدقيق بالتعزيز الموجه لعدم اليقين لتعديل حسابات وقت الاستنتاج ديناميكيًا، مما يقلل بشكل كبير من استهلاك الرموز مع الحفاظ على دقة التشخيص دون الحاجة إلى موجهات خارجية.

Shaohao Rui, Kaitao Chen, Weijie Ma, Xiaosong Wang2026-08-04
💬 NLP

LLM generation novelty through the lens of semantic similarity

تقترح هذه الورقة إطار عمل لاسترجاع دلالي ثلاثي المراحل وقابل للتوسع لقياس جدة توليد النماذج اللغوية الكبيرة مقابل مجموعات بيانات التدريب المسبق الكاملة، مما يكشف أن النماذج تستخدم البيانات عبر تسلسلات أطول مما كان يُعتقد سابقاً، وتُظهر أنماط جدة خاصة بمجالات معينة، وتزيد من الجدة من خلال الضبط الدقيق للتعليمات.

Philipp Davydov, Ameya Prabhu, Matthias Bethge, Elisa Nguyen, Seong Joon Oh2026-08-04
💬 NLP

Hylog: A Hybrid Approach to Logging Text Production in Non-alphabetic Scripts

تقدم هذه الورقة Hylog، وهو نظام تسجيل هجين جديد مفتوح المصدر يقوم بمزامنة إدخال لوحة المفاتيح مع النص المُصوَّر للتغلب على قيود أدوات تسجيل ضربات المفاتيح التقليدية في التقاط تحويلات محرك إدخال اللغة (IME) للنصوص غير الأبجدية، مما يتيح تحليلاً معرفياً أكثر دقة لإنتاج النصوص متعددة اللغات.

Roberto Crotti, Giovanni Denaro, Zhiqiang Du, Ricardo Muñoz Martín2026-08-04
💬 NLP

Transformers perform adaptive partial pooling

تُظهر هذه الورقة أن المحولات (transformers) تُبدي تجميعًا جزئيًا تكيفيًا مشابهًا للانحدار الهرمي من خلال الاستفادة من المعلومات المستمدة من السياقات غير المتكررة والمتشابهة، حيث يبلغ هذا السلوك ذروته عند "نقطة مثالية" محددة في التدريب حيث يتم تعظيم تأثير تكرار السياق قبل أن يتضاءل مع استمرار التدريب.

Vsevolod Kapatsinski2026-08-04
💬 NLP

Bagpiper: Solving Open-Ended Audio Tasks via Rich Captions

يُعدُّ "بايباغير" (Bagpiper) نموذجاً تأسيسياً صوتياً بحجم 8 مليارات معلمة، يستفيد من الأوصاف الغنية لإنشاء رسم خرائط ثنائي الاتجاه بين الصوت الخام والمفاهيم المعرفية عالية المستوى، مما يُمكِّن من الفهم والتوليد الشاملين والمفتوحين عبر الكلام والأصوات والموسيقى من خلال سير عمل مبتكر يعتمد على "الوصف ثم المعالجة".

Jinchuan Tian, Haoran Wang, Bo-Hao Su, Chien-yu Huang, Qingzheng Wang, Jiatong Shi, William Chen, Xun Gong, Siddhant Aro (…)2026-08-04
💬 NLP

On the Wings of Imagination: Conflicting Script-based Multi-role Framework for Humor Caption Generation

تقدم هذه الورقة HOMER، وهو إطار عمل جديد لنماذج اللغات الكبيرة متعدد الأدوار مدفوع بنظرية الفكاهة، يستفيد من التضادات السيناريوية، والتخيل الهرمي المعزز بالاسترجاع، وتوليد التعليقات المستهدف للتفوق بشكل كبير على الأساليب الحالية الرائدة في إنشاء تعليقات صور متعددة الوسائط مضحكة.

Wenbo Shang, Yuxi Sun, Jing Ma, Xin Huang2026-08-04
💬 NLP

Just on Time: Token-Level Early Stopping for Diffusion Language Models

تقدم هذه الورقة طريقة لإيقاف التشغيل المبكر على مستوى الرمز (token) لـنماذج اللغة الانتشارية (diffusion language models) لا تتطلب تدريباً، حيث تحدد وتنهي الرموز المستقرة ديناميكياً بناءً على إشارات تنبؤ خفيفة الوزن، مما يقلل التكاليف الحسابية بشكل كبير مع الحفاظ على جودة التوليد عبر مهام متنوعة.

Zakhar Kohut, Severyn Shykula, Mykola Vysotskyi, Serhii Dmytryshyn, Dmytro Khamula, Michal Zakrzewski, Damian Rynczak, J (…)2026-08-04
💬 NLP

What Makes Position Zero Special? A Mechanistic Study of Position Zero Attention Sinks in LLMs

تحدد هذه الورقة "دائرة بالوعة P0" (P0-Sink Circuit) هيكلية مسؤولة عن الانتباه غير المتناسب للموضع صفر في النماذج اللغوية الكبيرة السببية، وتثبت أن الطرق الخالية من المعلمات التي تسرع تشكل هذه البالوعة تعمل على تحسين كفاءة ما قبل التدريب والأداء في المهام اللاحقة.

Runyu Peng, Ruixiao Li, Mingshu Chen, Yunhua Zhou, Qipeng Guo, Xipeng Qiu, Yucheng Lu, Chen Zhao2026-08-04
💬 NLP

LangFIR: Discovering Sparse Language-Specific Features from Monolingual Data for Language Steering

تُعد LangFIR طريقة مبتكرة تحدد الميزات المتفرقة والخاصة بكل لغة في النماذج اللغوية الكبيرة متعددة اللغات باستخدام البيانات أحادية اللغة فقط وتصفية الرموز العشوائية، مما يتيح توجيهاً لغوياً عالي الفعالية يتفوق على الأساليب الحالية التي تعتمد على البيانات المتوازية المكلفة.

Sing Hieng Wong, Hassan Sajjad, A. B. Siddique2026-08-04
💬 NLP

Attention Sinks as Internal Signals for Hallucination Detection in Large Language Models

تقدم هذه الورقة SinkProbe، وهي طريقة متطورة للكشف عن الهلوسة تستفيد من "بالوعات الانتباه" (attention sinks) —وهي الرموز التي تراكم كتلة انتباه غير متناسبة— كإشارات داخلية تشير إلى التحول من الحوسبة المرتكزة على المدخلات إلى الحوسبة المرتكزة على المعرفة السابقة، بينما تكشف أيضاً أن الكشف الفعال يعتمد على بالوعات ذات معايير متجهات قيم كبيرة وتوحد النهج السابقة رياضياً مع هذه الآلية.

Jakub Binkowski, Kamil Adamczewski, Tomasz Kajdanowicz2026-08-04