💻 computer science

Goose: Anisotropic Speculation Trees for Training-Free Speculative Decoding

تُعد GOOSE إطار عمل للفك التخميني (speculative decoding) لا يتطلب تدريباً، حيث يستفيد من الفجوة النوعية الكبيرة بين الرموز (n-gram tokens) المتطابقة مع السياق والتنبؤات الإحصائية لبناء أشجار عمود فقري (spine trees) تباينية ومتكيفة، محققاً بذلك تسريعاً غير فاقد للجودة بنسبة تتراوح بين 1.9 و4.3 ضعفاً على نماذج لغوية كبيرة متنوعة عبر إعطاء الأولوية لسلاسل عميقة من الرموز عالية القبول على هياكل الأشجار المتوازنة.

Tao Jin, Phuong Minh Nguyen, Naoya Inoue2026-04-03
🤖 machine learning

Ouroboros: Dynamic Weight Generation for Recursive Transformers via Input-Conditioned LoRA Modulation

يقدم "أوروبوروس" (Ouroboros) نظاماً ديناميكياً لتوليد الأوزان للمحولات التكرارية يستخدم شبكة تحكم فائقة (Controller hypernetwork) مشروطة بالمدخلات لتعديل قواعد "لورا" (LoRA) المجمدة عند كل خطوة تكرار، مما يقلل بشكل كبير من خسارة التدريب ويستعيد فجوات الأداء في البنى المضغوطة مع تسليط الضوء على الدور الحاسم للتكرار المبوّب والقيود الحالية للتعميم على البيانات غير المحتفظ بها.

Jaber Jaber, Osama Jaber2026-04-03
⚡ electrical engineering

Prosodic ABX: A Language-Agnostic Method for Measuring Prosodic Contrast in Speech Representations

تقدم هذه الورقة البحثية "prosodic ABX"، وهي طريقة محايدة لغوياً وخالية من الملصقات لتقييم التباين النبري في نماذج الكلام ذاتية الإشراف، والتي تم التحقق من صحتها عبر اللغات الإنجليزية واليابانية والماندارين باستخدام مجموعة بيانات تم إصدارها حديثاً، وأظهرت قدرة على تقديم ترتيب متسق للنماذج بما يتناسب مع بيئات الموارد المنخفضة.

Haitong Sun, Stephen McIntosh, Kwanghee Choi, Eunjung Yeo, Daisuke Saito, Nobuaki Minematsu2026-04-03
💻 computer science

Reliable Control-Point Selection for Steering Reasoning in Large Language Models

تقدم هذه الورقة طريقة قائمة على الموثوقية لتوجيه النماذج اللغوية الكبيرة تتغلب على عدم الاستقرار العالي لحدود الاستدلال المكتشفة عبر الكلمات المفتاحية من خلال توظيف تصفية الاستقرار وإسقاط الفضاء الجزئي للمحتوى، مما يحقق أداءً هو الأفضل حالياً في MATH-500 ويظهر قدرة قوية على الانتقال عبر النماذج.

Haomin Zhuang, Hojun Yoo, Xiaonan Luo, Kehan Guo, Xiangliang Zhang2026-04-03
💻 computer science

MTI: A Behavior-Based Temperament Profiling System for AI Agents

تقدم هذه الورقة "مؤشر مزاج النموذج" (MTI)، وهو نظام لتوصيف السلوك قائم على "نموذج القشرة الرباعي" يقيس مزاج الوكيل الذكي عبر أربعة محاور مستقلة — التفاعلية، والامتثال، والاجتماعية، والمرونة — لإثبات أن الاستعدادات السلوكية متميزة عن القدرة، وتتفاوت بشكل مستقل عن حجم النموذج، ويتم إعادة تشكيلها جوهرياً من خلال محاذاة التعلم المعزز من التغذية الراجعة البشرية (RLHF).

Jihoon Jeong2026-04-03
💻 computer science

Brief Is Better: Non-Monotonic Chain-of-Thought Budget Effects in Function-Calling Language Agents

تكشف هذه الورقة أنه في وكلاء اللغة الذين يستخدمون استدعاء الوظائف، يعزز تسلسل الأفكار الموجز (حوالي 32 رمزاً) الدقة بشكل كبير من خلال العمل كآلية فعالة لتوجيه الوظائف، بينما يؤدي التفكير الممتد إلى تدهور الأداء عبر زيادة الهلوسة، مما أدى إلى اقتراح طريقة "تسلسل الأفكار لتوجيه الوظائف" المهيكلة التي تضمن الموثوقية دون الحاجة إلى ضبط مكثف للميزانية.

Xuan Qi2026-04-03
🔭 astrophysics

AstroConcepts: A Large-Scale Multi-Label Classification Corpus for Astrophysics

تقدم هذه الورقة AstroConcepts، وهي مجموعة بيانات ضخمة من ملخصات الفيزياء الفلكية المصنفة بـ 2,367 مفهوماً من "قاموس مصطلحات الفلك الموحد" لمعالجة عدم التوازن الشديد في الفئات، مع وضع خطوط أساس تكشف عن إمكانات النماذج اللغوية الكبيرة المقيدة بالمفردات وضرورة التقييم الطبقي القائم على التكرار للتصنيف العلمي متعدد الملصقات.

Atilla Kaan Alkan, Felix Grezes, Sergi Blanco-Cuaresma, Jennifer Lynn Bartlett, Daniel Chivvis, Anna Kelbert, Kelly Lock (…)2026-04-03
🤖 machine learning

Do Lexical and Contextual Coreference Resolution Systems Degrade Differently under Mention Noise? An Empirical Study on Scientific Software Mentions

تقدم هذه الورقة نظام ترتيب في المركز الثاني لمهمة SOMD 2026 المشتركة، والذي يقارن بين نهجي المراجع المعجمي والسياقي اللذين لا يتطلبان ضبطًا دقيقًا، كاشفةً أنه بينما تتفوق النماذج السياقية عمومًا على النماذج المعجمية، فإن متانتها النسبية تجاه أنواع محددة من الضجيج وقابليتها الفائقة للتوسع تجعلها الخيار المفضل لحل مشكلة تحديد مراجع البرمجيات العلمية واسعة النطاق.

Atilla Kaan Alkan, Felix Grezes, Jennifer Lynn Bartlett, Anna Kelbert, Kelly Lockhart, Alberto Accomazzi2026-04-03
💻 computer science

Adam's Law: Textual Frequency Law on Large Language Models

تقدم هذه الورقة "قانون آدم"، وهو إطار عمل يقترح أن إعطاء الأولوية للبيانات النصية المتكررة من خلال إعادة الصياغة، والتقطير، والضبط الدقيق القائم على المنهج الدراسي، يعزز بشكل كبير أداء النماذج اللغوية الكبيرة عبر مهام متنوعة.

Hongyuan Adam Lu, Z. L., Victor Wei, Zefan Zhang, Zhao Hong, Qiqi Xiang, Bowen Cao, Wai Lam2026-04-03
🤖 machine learning

The Expert Strikes Back: Interpreting Mixture-of-Experts Language Models at Expert Level

تُثبت هذه الورقة أن التناثر المتأصل في بنيات "خليط الخبراء" (MoE) يعزز من أحادية المعنى، مما يتيح قابلية تفسير أكثر فعالية على مستوى الخبير، حيث يعمل كل خبير بشكل فردي كمتخصص دقيق في مهام معينة بدلاً من كونه خبيراً واسع النطاق في مجال ما أو مجرد معالج للرموز.

Jeremy Herbst, Jae Hee Lee, Stefan Wermter2026-04-03