🤖 AI

Open-Weight Masked Introspection: Measuring What Language Models Can Report About Their Own Computation

تقدم هذه الورقة إطار عمل "الاستبطان المقنع مفتوح الأوزان" (OWMI) لاختبار ما إذا كانت النماذج اللغوية الرائدة يمكنها الإبلاغ بدقة عن تغيراتها الحسابية الداخلية، حيث وجدت أنه بينما تتوفر المعلومات اللازمة داخل تنشيطاتها، تفشل النماذج الحالية مفتوحة الأوزان في ترجمة هذه الحالة الداخلية إلى تقارير لفظية موثوقة، حيث لا تؤدي أفضل من مستوى الصدفة.

Emilio Ferrara2026-08-24
💬 NLP

When Failures Propagate: Causal Failure Attribution in Agentic Retrieval-Augmented Generation

تقدم هذه الورقة البحثية AgenticRAG-FP، وهو معيار تدخلي لعزو الفشل السببي في أنظمة RAG الوكيلية، والذي يكشف عن فقدان كبير في الإشارة اللاحقة عند تشخيص حالات الفشل أثناء انتشارها عبر عدة قفزات استدلالية، حيث تنخفض نسبة التشخيص القائم على التغطية من 0.91 في القفزة الأولى إلى 0.00 في القفزات اللاحقة.

Lauren Pothuru2026-08-24
💬 NLP

PSK at WMT 2026 MIST: Task-Specialized QLoRA Adapters for Multilingual Summarization and Question Answering

تستخدم مشاركة PSK في مسابقة WMT 2026 MIST نموذج Tiny Aya Global بـ 3.35 مليار معلمة، معززاً بثلاثة محولات QLoRA متخصصة في المهام للتلخيص متعدد اللغات والإجابة على الأسئلة، مستفيدة من بيانات تدريب متنوعة للتفوق على خط الأساس متعدد المهام في التقييمات المحجوزة، مع تقديم تكوينات متعددة لمعالجة نتائج الأسئلة المفتوحة المختلطة.

Srikar Kashyap Pulipaka2026-08-24
💬 NLP

Tree-of-Concerns: Hierarchical Multi-Agent Debate for Unstated-Limitation Extraction in Scientific Critique

تقدم الورقة البحثية "شجرة المخاوف" (Tree-of-Concerns)، وهو إطار عمل هرمي للمناظرة بين وكلاء متعددين يستخدم شخصيات تشكيكية متخصصة وآلية مراجعة من لجنة لانتزاع القيود غير المعلنة من الأوراق العلمية بشكل منهجي، محققاً تحسينات كبيرة في الدقة والشمول مقارنة بالنماذج المرجعية الحالية.

Sahil Mishra, Niranjan Rajeev, Tanmoy Chakraborty2026-08-24
💬 NLP

Profiling What Matters: Context-Aware Item Profiles from Large-Scale Metadata for LLM Recommenders

تقترح هذه الورقة إطار عمل CAIRO، وهو إطار لتوصيف العناصر يراعي سياق المستخدم، يقوم بهيكلة البيانات الوصفية غير المتجانسة واختيار المعلومات ذات الصلة لكل زوج من (المستخدم-العنصر) ديناميكيًا لتعزيز أداء إعادة الترتيب القائم على النماذج اللغوية الكبيرة.

Dojun Hwang, Seunghan Lee, Cheonyoung Park, Sara Yu, SeongKu Kang2026-08-24
💬 NLP

Ontology-Driven Structural Regularization for Document-Level Relation Extraction

تقدم هذه الورقة إطار عمل للتنظيم الهيكلي القائم على الأنطولوجيا، والذي يحدد ويخفف من التناقضات المنطقية في مجموعات بيانات الإشراف البعيد، مما يحسن بشكل كبير من أداء التعميم لنماذج استخراج العلاقات على مستوى المستند.

Laura Menotti, Stefano Marchesin, Gianmaria Silvello2026-08-24
💬 NLP

Source-Free MT Evaluation Is Not MT Evaluation

تجادل هذه الورقة بأن تقييم الترجمة الآلية يجب أن يكون مرتكزاً بشكل أساسي على المصدر لضمان الكفاية، داعيةً إلى تحول جذري في النموذج حيث يُعامل تقدير الجودة كطريقة تقييم أولية، بينما تُستخدم المراجع فقط كأدلة مساعدة بدلاً من كونها المعيار المهيمن.

Baban Gain, Ramakrishna Appicharla, Asif Ekbal2026-08-24
💬 NLP

TreeWY: Speculative Verification for Gated DeltaNet Hybrids

يقدم TreeWY تحويلاً هيكلياً شجرياً من نوع WY يلغي الحاجة إلى لقطات الحالة المتكررة لكل عقدة في فك التشفير التخميني لنماذج Gated DeltaNet الهجينة، مما يقلل بشكل كبير من ضغط الذاكرة ويحسن الإنتاجية أو يتيح أشجار مسودة أوسع دون التضحية بطول القبول.

Sneha Murthy Ghantasala2026-08-24
💬 NLP

Extractive Summarization for Arabic Documents Using SAraBERT with a Semantic Siamese Similarity Evaluation Metric

تقدم هذه الورقة البحثية نموذج SAraBERT، وهو نموذج محول (transformer) عربي مطور للتلخيص الاستخراجي يتضمن طبقات بين الجمل، وتم تقييمه باستخدام مقياس التشابه الدلالي التوأمي (Semantic Siamese Similarity) المبتكر إلى جانب درجات BLEU وROUGE التقليدية.

Sami Shames El Deen, Mariette Awad2026-08-24
💬 NLP

Target-Aware Calibration Data Selection for Preserving Uncertainty in Quantized Language Models

تقدم هذه الورقة البحثية "الكمّنة الحافظة للشك" (DPQ)، وهي إطار عمل يختار بيانات المعايرة بناءً على أهداف نشر محددة للحفاظ بشكل أفضل على سلوكيات عدم اليقين مثل الثقة والامتناع في النماذج اللغوية المكمّنة، مما يثبت أن الاختيار الأمثل للبيانات يختلف اعتمادًا على هدف الحفظ المنشود بدلاً من اتباع وصفة ثابتة.

Zhen Yang, Sizai Hou, Kaiwen Zheng, Yaofang Liu, Liang He, Yixuan Chen, Kangning Cui2026-08-24