💬 NLP

CroCo: Cross-Lingual Contrastive Preference Tuning on Self-Generations

تقدم الورقة البحثية CroCo، وهي طريقة تثبت أن الضبط التفضيلي التبايني عبر اللغات باستخدام استجابات مولدة ذاتياً ونموذج مكافأة مدرب باللغة الإنجليزية يحسن بفعالية أداء النماذج اللغوية الكبيرة متعددة اللغات عبر مهام متنوعة دون الحاجة إلى تعليقات تفضيلية خاصة بكل لغة، شريطة استخدام بيانات السياسة المباشرة (on-policy data).

Mike Zhang, Ali Basirat, Desmond Elliott2026-05-27
🤖 machine learning

QAM-W: Joint 2D Codebook Quantization for LLM Weights via Hadamard Rotation and Activation-Aware Scaling

يقدم QAM-W طريقة تكميم كتاب رموز ثنائي الأبعاد مشترك لأوزان النماذج اللغوية الكبيرة تستخدم دوران هادامارد والتحجيم الواعي للتنشيط للحفاظ على هياكل الإحداثيات الزوجية، محققاً تقاربًا مع مستويات إرباك (perplexity) تنسيق BF16 عند حوالي 5.5 بت لكل وزن، مع التفوق على الترميز القطبي ومضاهاة جودة SmoothQuant بعدد أقل بكثير من بتات الأوزان.

Preetam Sharma, Kacper Dobek2026-05-27
🤖 AI

ScientistOne: Towards Human-Level Autonomous Research via Chain-of-Evidence

تقدم الورقة البحثية "ScientistOne"، وهو نظام بحثي ذاتي التشغيل مبني على إطار عمل "سلسلة الأدلة" (Chain-of-Evidence) الذي يضمن القابلية للتحقق من خلال البناء، مما يلغي الاستشهادات المهلوسة ويحقق درجة تحقق مثالية ومواءمة فائقة بين المنهجية والبرمجية، مع مضاهاة أو تجاوز أداء الخبراء البشريين عبر مهام بحثية رائدة متنوعة.

Rui Meng, Bhavana Dalvi Mishra, Jiefeng Chen, Chun-Liang Li, Palash Goyal, Mihir Parmar, Yiwen Song, Yale Song, Rajarish (…)2026-05-27
💬 NLP

The Daily Dose: Workflow-Integrated Large Language Model Automation for Clinical Summarization and Trial Identification in Radiation Oncology

تقدم هذه الدراسة تصميم وتقييم أولي لنظام "The Daily Dose"، وهو نظام مدعوم بنماذج اللغات الكبيرة (LLM) مدمج في سير عمل علاج الأورام بالإشعاع، يقوم تلقائياً بإنشاء ملخصات للمرضى وتحديد التجارب السريرية، مما أظهر رضا عالياً لدى الأطباء، وموثوقية ممتازة، وتوفيراً ملحوظاً في الوقت الملحوظ في استطلاع ذي منهج مختلط شمل 55 مستجيباً.

Jason Holmes, Federico Mastroleo, Mariana Borras-Osorio, Srinivas Seetamsetty, Satomi Shiraishi, Mirek Fatyga, Judy C. B (…)2026-05-27
💬 NLP

RICE-PO: Turning Retrieval Interactions into Credit Signals for Reasoning Agents

تقترح الورقة البحثية RICE-PO، وهو إطار عمل لتحسين السياسات خالٍ من الناقد (critic-free) يقوم بتحويل تفاعلات الاسترجاع إلى إشارات تعلم محلية باستخدام الأفعال القابلة للتنفيذ ذات عدم اليقين العالي كمرتكزات لتعيين الائتمان لخطوات الاستدلال الكامنة، مما يؤدي إلى تحسين تدريب وكلاء الاستدلال التفاعلي على معايير مثل BRIGHT وBEIR.

Mingchen Li, Hansi Zeng, Zhuo Qian, Jiatan Huang, Hamed Zamani, Hong Yu2026-05-27
⚡ electrical engineering

Energy-Gated Attention and Wavelet Positional Encoding: Complementary Inductive Biases for Transformer Attention

تقترح هذه الورقة "انتباه البوابة الطاقية" (Energy-Gated Attention) و"ترميز مورليه الموضعي" (Morlet Positional Encoding) كتحيزات استقرائية متكاملة، والتي تؤدي عند دمجها إلى تحسينات في الأداء تتجاوز المجموع الحسابي للنماذج القياسية عبر تعلم بوابات بروز الرموز وتوطين التأثير الموضعي تكيفياً عبر المقاييس، رغم أن النتائج تعتمد حالياً على تجارب صغيرة النطاق تتطلب مزيداً من التحقق واسع النطاق.

Athanasios Zeris2026-05-27
💬 NLP

In-Context Optimization for Retrieval-Augmented Generation: A Gradient-Descent Perspective

تعيد هذه الورقة صياغة عملية التوليد المعزز بالاسترجاع (RAG) باعتبارها عملية تحسين داخل السياق، وذلك من خلال إثبات أن طبقات الانتباه الذاتي الخطية يمكنها تنفيذ خطوات الانحدار الاشتقاقي على هدف استرجاع موحد، مما يؤدي إلى طريقة خفيفة الوزن وتعتمد على التمرير الأمامي فقط تعمل على تعزيز نماذج الـ RAG المجمدة عبر التنبؤ بالتحديثات المشروطة بالسياق لاستخدام الأدلة دون الحاجة إلى تكيف اشتقاقي في وقت الاختبار.

Mingchen Li, Jiatan Huang, Chuxu Zhang, Liang Zhao, Hong Yu2026-05-27
💬 NLP

Annotator Positionality as Signal: Psychometric Weighting for Anti-Autistic Ableism Detection

تقدم هذه الورقة إطار تقييم بوزن سيكومتري يعطي الأولوية لمنظورات المقيّمين التوحديين للكشف عن كيفية قيام النماذج اللغوية الكبيرة، وبشكل متكرر، بتصنيف اللغة المستعادة خطأً على أنها متحيزة ضد ذوي الإعاقة والاعتماد على مطابقة الكلمات المفتاحية السطحية بدلاً من الفروق السياقية الدقيقة عند تقييم التحيز ضد التوحد.

Naba Rizvi, Harper Strickland, Saleha Ahmedi, Nedjma Ousidhoum2026-05-27
💬 NLP

Towards Just-in-Time Adaptive Feedback: Enhancing Student Learning via Knowledge-Grounded LLM

تقدم هذه الورقة إطار عمل لنماذج لغوية كبيرة قائمة على المعرفة، يقدم تغذية راجعة تكيفية في الوقت المناسب بناءً على منطق الاستدلال لدى الطلاب، مما نجح في تحسين الأداء بنسبة تزيد عن 80% في مساق جامعي واسع النطاق من خلال تصحيح المفاهيم الخاطئة بفعالية عبر حوار تكراري.

Younghun Lee, Amir Bralin, Nobel Sanjay Rebello, Dan Goldwasser2026-05-27
💬 NLP

Probing Minimalist Phase Structure in LLMs: What Universal Dependencies Cannot Represent

تُثبت هذه الورقة أن النماذج اللغوية الكبيرة ترمز تجريدات صياغية-نحوية مثل حدود الطور في "البرنامج الأدنى" والتماسك —وهي مفاهيم غير مرئية لـ "التبعية العالمية"— من خلال الكشف عن أن السبر الهيكلي يرصد تدرجات عدد الأطوار وعدم تماثل العلامات في محفزات حركة أسئلة الاستفهام (wh-movement) التي لا يستطيع السبر القائم على "التبعية العالمية" معيارياً التقاطها.

Yuanhao Chen, Peter Chin2026-05-27