💬 NLP

Three Models of RLHF Annotation: Extension, Evidence, and Authority

تقترح هذه الورقة التمييز بين ثلاثة نماذج مفاهيمية للمُعلّقين البشريين في التعلم التعزيزي من التغذية الراجعة البشرية (RLHF) —وهي: الامتداد، والدليل، والسلطة— لتوجيه تصميم مسارات تعليق أكثر فعالية عبر تخصيص استراتيجيات جمع وتجميع البيانات لتناسب الدور المعياري المحدد لكل بُعد من أبعاد محاذاة النموذج.

Steve Coyne2026-04-29
💬 NLP

Toward a Functional Geometric Algebra for Natural Language Semantics

تقترح هذه الورقة إطار عمل للجبر الهندسي الوظيفي (FGA) يستفيد من جبر كليفورد للتغلب على القيود الهيكلية للجبر الخطي التقليدي في دلالات اللغة الطبيعية، مما يوفر نظاماً مبدئياً، ونوعياً، وتركيبياً لتمثيل المفاهيم الدلالية وتفاعلاتها ضمن فضاء متعدد المتجهات موحد.

James Pustejovsky2026-04-29
💬 NLP

Recursive Multi-Agent Systems

تقدم هذه الورقة البحثية RecursiveMAS، وهو إطار عمل متعدد الوكلاء تكراري يوحد الوكلاء غير المتجانسين في حلقة تعاون في الفضاء الكامن باستخدام خوارزمية تعلم مبتكرة، محققاً تحسينات كبيرة في الدقة، وسرعة الاستدلال، وكفاءة الرموز (tokens) عبر معايير متنوعة مقارنة بالأنظمة الحالية أحادية ومتعددة الوكلاء.

Xiyuan Yang, Jiaru Zou, Rui Pan, Ruizhong Qiu, Pan Lu, Shizhe Diao, Jindong Jiang, Hanghang Tong, Tong Zhang, Markus J. (…)2026-04-29
💻 computer science

EXCEEDS: Extracting Complex Events via Nugget-based Grid Modeling in Scientific Domain

لمعالجة نقص الموارد الشاملة والأساليب المخصصة لاستخراج الأحداث العلمية، قدم المؤلفون SciEvents، وهو مجموعة بيانات ضخمة متعددة الأحداث، وEXCEEDS، وهو إطار عمل شامل (end-to-end) يعمل على نمذجة الكيانات الدقيقة (nuggets) عبر مصفوفة شبكية لتحقيق أداء رائد.

Yi-Fan Lu, Xian-Ling Mao, Bo Wang, Xiao Liu, Heyan Huang2026-04-28
💬 NLP

Beyond Math: Stories as a Testbed for Memorization-Constrained Reasoning in LLMs

تقدم هذه الورقة طريقة للتخفيف من حدة الحفظ في النماذج اللغوية الكبيرة من خلال التمييز بين ذاكرة الجوهر والذاكرة الحرفية، مما يكشف أن الاختبارات المرجعية الحالية للأعمال الخيالية الشهيرة غالباً ما تبالغ في تقدير الفهم الحقيقي للشخصيات بسبب تلوث البيانات.

Yuxuan Jiang, Francis Ferraro2026-04-28
💻 computer science

CODESIM: Multi-Agent Code Generation and Problem Solving through Simulation-Driven Planning and Debugging

تقدم الورقة البحثية CodeSim، وهو إطار عمل جديد متعدد الوكلاء يحقق أداءً رائدًا في توليد الكود البرمجي من خلال توظيف نهج يحاكي البشر ويعتمد على المحاكاة للتحقق من الخطط وتصحيح الأخطاء الداخلي عبر سبعة معايسات اختبارية صعبة.

Md. Ashraful Islam, Mohammed Eunus Ali, Md Rizwan Parvez2026-04-28
💻 computer science

Speech-FT: Merging Pre-trained And Fine-Tuned Speech Representation Models For Cross-Task Generalization

تقترح الورقة البحثية Speech-FT، وهو إطار عمل جديد للضبط الدقيق يتكون من مرحلتين يجمع بين تقليل الانحراف التمثيلي وبين الاستيفاء في فضاء الأوزان لتعزيز الأداء الخاص بالمهمة مع الحفاظ على القدرة على التعميم عبر المهام بل وتحسينها مقارنة بطرق التنظيم الحالية.

Tzu-Quan Lin, Wei-Ping Huang, Hao Tang, Hung-yi Lee2026-04-28
💬 NLP

Can LLMs Interpret and Leverage Structured Linguistic Representations? A Case Study with AMRs

تُظهر هذه الورقة أنه في حين أن تعزيز المطالبات بهياكل تمثيل المعنى المجرد (AMR) يؤدي عمومًا إلى تدهور الأداء في المهام ذات السياق القصير، إلا أنه يعزز بشكل كبير قدرات النماذج اللغوية الكبيرة والجديدة في سيناريوهات السياق الطويل مثل تلخيص الحوار، ويُمكّن من إعادة بناء النصوص بفعالية من هياكل AMR الخطية.

Ankush Raut, Xiaofeng Zhu, Maria Leonor Pacheco2026-04-28
🤖 machine learning

Always Tell Me The Odds: Fine-grained Conditional Probability Estimation

تقترح الورقة البحثية نهجاً جديداً يمثل أحدث ما توصل إليه العلم في مجال تقدير الاحتمالية الشرطية دقيقة التفاصيل في النماذج اللغوية الكبيرة، وذلك عبر استخدام مزيج من البيانات البشرية والاصطناعية، والتوسع، وتحسين الإشراف للتغلب على المشكلات الحالية المتعلقة بالتنبؤات الاحتمالية الفجة والمنحازة.

Liaoyaqi Wang, Zhengping Jiang, Anqi Liu, Benjamin Van Durme2026-04-28