💬 NLP

Iterate Until Retrieved: Factual Nugget Optimization for Discoverable Continual Corrections in Agentic RAG

تقدم هذه الورقة البحثية طريقة "تحسين النواة التكراري" (INO)، وهي طريقة تُنفذ عند وقت الفهرسة تعمل على تحويل التصحيحات الواقعية حرة التنسيق إلى "نواة واقعية" مُحسّنة من خلال تنقيحها تكرارياً عبر اختبار وكلاء استرجاع المعلومات المعزز (RAG) في بيئة الإنتاج لضمان قابليتها للاكتشاف واستخدامها الفعال في أنظمة المساعدة المعرفية الموجهة للشركات (B2B).

Moshe Hazoom, Gal Patel, Alon Talmor, Tom Hope2026-05-26
💬 NLP

A Two-Phase Stability Study of LLM Judges and Bar Council Examiners on Thai Bar-Exam Free-Form Essays

تكشف هذه الدراسة أنه في حين تتقارب أحكام النماذج اللغوية الكبيرة مع المصححين البشريين في مقالات امتحان المحاماة التايلاندي ذات المعايير الواضحة، إلا أن النماذج اللغوية الكبيرة تفشل بشكل منهجي في إعادة إنتاج تفسير الأقلية البشرية في الحالات الغامضة، حيث تتماشى بدلاً من ذلك بشكل موحد مع وجهة نظر الأغلبية البشرية، مما يؤدي بالتالي إلى حجب عدم قدرتها على استيعاب الطيف الكامل للاختلاف بين الخبراء.

Pawitsapak Akarajaradwong, Wuttikrai Lertprasertphakorn, Chompakorn Chaksangchaichot, Sarana Nutanong2026-05-26
💬 NLP

Llamion Technical Report

تقدم الورقة البحثية Llamion، وهي عائلة من النماذج ذات الأوزان المفتوحة بـ 14 مليار معلمة، والتي نجحت في تحويل بنية Orion-14B إلى تنسيق Llama باستخدام وصفة مبتكرة تسمى KEPT، محققةً أداءً هو الأفضل في فئته على معايير مثل KoMMLU ومحافظةً على قدرات متقدمة مثل التعامل مع السياقات الطويلة بأقل موارد تدريبية.

Kisu Yang, Yoonna Jang, Hyeonseok Moon, Hwanseok Jang, Taewoo Lee, Hyungjin Lee, Jeseung Lee, Juhyoung Park, Heuiseok Li (…)2026-05-26
💬 NLP

Simulating Human Memory with Language Models

توضح هذه الورقة أنه بينما تمتلك النماذج اللغوية الجاهزة ذاكرة موثوقة بشكل غير واقعي مقارنة بالبشر، فإن تطبيق استراتيجيات توجيه محددة ومكثفات للذاكرة يمكن أن يؤدي إلى إحداث نسيان شبيه بالبشر، مما يعزز فعاليتها كمحاكيات للمستخدمين في السياقات التعليمية.

Qihan Wang, Nicholas Tomlin, Michael Hu, Brian Dillon, Tal Linzen2026-05-26
💬 NLP

Neural Router: Semantic Content Matching for Agentic AI

تقترح هذه الورقة البحثية "Neural Router"، وهو نظام يستفيد من النماذج اللغوية الكبيرة كمحركات مطابقة دلالية للذكاء الاصطناعي الوكيل في بيئات الحافة والسحابة، حيث تثبت من خلال تحليل مجموعات بيانات متعددة أن اختيار النموذج الخلفي أكثر أهمية من تكوين خط الأنابيب، وتحدد عتبات دقة وتكلفة محددة تصبح عندها تقنيات الضغط والنماذج ذات النطاق الرائد ضرورية.

Lauri Lovén, Abhishek Kumar, Alexander Engelhardt, Alaa Saleh, Roberto Morabito, Xiaoli Liu, Naser Hossein Motlagh, Sasu (…)2026-05-26
💬 NLP

CMAP: Cross-Modal Adaptive Prompting for Multi-Domain Task-Incremental Learning

يقدم CMAP إطار عمل فعال في المعلمات للتعلم التزايدي للمهام متعددة المجالات، والذي يستفيد من فضاء تضمين النص غير المستغل في نموذج CLIP لتوجيه المهام بمتانة، وتقدير الثقة، وتكييف المشفر، محققاً أداءً هو الأفضل في حالته على معيار MTIL دون بيانات خارجية أو معلومات عن هوية المهمة.

Sriram Mandalika2026-05-26
📊 statistics

Efficient Benchmarking Is Just Feature Selection and Multiple Regression

تُثبت هذه الورقة أن تقييم النماذج اللغوية الكبيرة (LLM) بكفاءة يمكن تحسينه بشكل كبير من خلال إعادة صياغة المشكلة كنموذج انحدار متعدد باستخدام انحدار الحافة الجيرية (kernel ridge regression) للتنبؤ وخوارزمية الحد الأدنى من الارتباط مع الحد الأقصى من التباين (mRMR) لاختيار المجموعات الفرعية المثلى من الأسئلة، مما يؤدي إلى أخطاء تنبؤ أقل، وارتباطات ترتيب أعلى، وأداء أسرع وأكثر استقرارًا مقارنة بالطرق الحالية.

Sam Bowyer, Acyr Locatelli, Kris Cao2026-05-26
💬 NLP

Double Triangle Annotation: A Scalable Human-in-the-Loop Framework for High-Precision Historical Document Annotation

تقدم هذه الورقة "توسيم المثلث المزدوج" (Double Triangle Annotation)، وهو إطار عمل قابل للتوسع يعتمد على تدخل العنصر البشري، يستفيد من الإجماع عبر النماذج بين نموذجين لغويين كبيرين متعددي الوسائط ومستقلين لأتمتة أكثر من 85% من مهام توسيم الوثائق التاريخية مع تحقيق معدل خطأ في الكلمات (WER) عالي الدقة يبلغ 0.003 على مجموعة نصوص "Guides Rosenwald" الطبية الفرنسية.

Yi Ren2026-05-26
💬 NLP

SAMark: A Self-Anchored Text Watermarking with Paragraph-Level Paraphrase Robustness

تقترح الورقة البحثية SAMark، وهو إطار عمل للعلامات المائية النصية ذاتية الارتكاز يحقق مقاومة قوية لإعادة الصياغة على مستوى الفقرة من خلال إنشاء ركائز دلالية مستقلة عن الخطوات واستخدام تسجيل زائدي متعدد القنوات، متفوقاً بشكل ملحوظ على النماذج المرجعية السابقة مع الحفاظ على جودة توليد عالية.

Jiahao Huo, Wenjie Qu, Yibo Yan, Kening Zheng, Jiaheng Zhang, Xuming Hu, Philip S. Yu, Mingxun Zhou2026-05-26
💬 NLP

Fine-Tuning Over Architectural Complexity: Broad-Coverage PII Detection on PIIBench with DeBERTa

تثبت هذه الورقة أن نموذج DeBERTa بسيط تم ضبطه بدقة مباشرة يتفوق على النهج الأكثر تعقيداً من حيث البنية والمنهج التعليمي في الكشف عن معلومات الهوية الشخصية (PII) واسعة النطاق عبر 82 نوعاً من الكيانات، مما يثبت أن تنوع بيانات التدريب الخاصة بالمهمة أكثر أهمية من تعقيد البنية.

Pritesh Jha2026-05-26