💬 NLP

Transformer Models for Text Summarization: A Comparative Study of BART, BERT, and RoBERTa

تقدم هذه الورقة مراجعة مقارنة للنماذج القائمة على تقنية المحولات (Transformer)، وتحديداً BERT وRoBERTa وBART، حيث تحلل بنياتها واستراتيجيات التدريب المسبق الخاصة بها لتقييم مدى ملاءمتها لمهام التلخيص التلقائي للنصوص الاستخراجي والتجريدي.

Daisy Aptovska, Vinayak Elangovan2026-08-21
💬 NLP

Hallucination as a Feature, not a Defect: Evaluating a multi-agent architecture to transform speculative language-model outputs into testable scientific hypotheses

تقترح هذه الورقة بنية متعددة الوكلاء قائمة على لغة "رست" (Rust) تعيد صياغة هلوسات النماذج اللغوية الكبيرة كسمة إبداعية من خلال تنسيق التوتر بين التوليد التأملي عالي الإنتروبيا والتأصيل التجريبي منخفض الإنتروبيا، مبرهنةً على أن مثل هذا النظام يتفوق في إنتاج فرضيات علمية قابلة للتطبيق، وتحديداً عندما يجب أن تستوفي قيوداً فيزيائية أو مؤسسية صارمة.

Nicolas Rodriguez-Alvarez (IES Parquesol, Valladolid, Spain)2026-08-21
💬 NLP

When Irrelevant Text Matters: Affine Margin Shifts in Multimodal Large Language Models

تكشف هذه الورقة أن النصوص غير المرتبطة بالمهمة في النماذج اللغوية الكبيرة متعددة الوسائط تحيز أحكام الرؤية الثنائية بشكل منهجي عبر إحداث تحويل تآلفي يمكن التنبؤ به في هوامش القرار، مما يميز هذا التأثير كتشويه هندسي قابل للتقدير بدلاً من كونه ضوضاء غير منظمة.

Yinfeng Wang, Zhiyuan Yao, Zheren Fu, Lei Zhang, Zhendong Mao2026-08-21
💬 NLP

Represented but Ignored: A Causal Account of Prosodic Underuse in Audio-Language Models

تقدم هذه الورقة "سلم مسبار سببي" (causal probe ladder) لتوضيح أن نماذج اللغة والصوت تحافظ عادةً على المعلومات العروضية (prosodic information) وتمثلها بشكل صحيح في حالاتها الداخلية، لكنها تفشل في استخدامها في استجاباتها النهائية، وهو عنق زجاجة يمكن التغلب عليه من خلال تدخلات مستهدفة في الحالة الخفية.

Linkai Peng, Baorian Nuchged2026-08-21
💬 NLP

NepOOC-M: Bilingual Nepali-English Benchmark and Comparative Analysis of Multimodal Architectures for OOC Detection

تقدم هذه الورقة البحثية NepOOC-M، وهو أول معيار ثنائي اللغة للنيبالية والإنجليزية للكشف عن المعلومات المضللة خارج السياق، وتثبت أن النماذج التي تعتمد على النصوص فقط تحقق أداءً مكافئاً إحصائياً للهياكل المعقدة متعددة الوسائط، مما يشير إلى أن توسيع مجموعة البيانات هو عامل أكثر أهمية للتقدم من تطور البنية الهيكلية.

Sanjeev Khatiwada2026-08-21
💬 NLP

Outcome Monitors: Recovery Affordances for Silent Tool Failures

تقدم هذه الورقة "مراقب النتائج" (Outcome Monitors)، وهي آلية تكتشف حالات فشل الأدوات الصامتة من خلال التحقق من عقود النتائج وإصدار إيصالات مع أدوات الاسترداد، مما يحسن معدلات إتمام المهام في تقييمات الوكلاء بشكل كبير، مع تسليط الضوء على أن الكشف الحالي يعتمد بشكل كبير على المفردات المستخرجة.

Sugam Panthi, Rabab Abdelfattah2026-08-21
💬 NLP

Linguistic Holonomy and Statistical Watermarks: Inner Geometry of Meaning-Preserving Transformations

تُثبت هذه الورقة أن العلامات المائية الإحصائية للنماذج اللغوية معرضة بشكل جوهري للتحويلات الحافظة للمعنى لأن اكتشافها يعتمد على التشابه الدلالي للنقاط النهائية بدلاً من "الهولونومي" (التعامد) الخفي لمسار التحويل، مما يؤدي إلى هوية رياضية دقيقة تُظهر أن بقاء الإشارة يعتمد بشكل حاسم على الموقع المحدد للتعديلات بدلاً من مجرد معدل الاستبقاء الإجمالي.

Daniele Corradetti2026-08-21
💬 NLP

Are LLMs becoming similarly creative? Evidence from three years of models

تحلل هذه الورقة ثلاثة أعوام من إصدارات النماذج اللغوية الكبيرة وتجد انخفاضاً ذا دلالة إحصائية في تنوع المخرجات في المهام الإبداعية مفتوحة النهايات، مما يشير إلى اتجاه نحو التجانس قد يقلل من الوكالة البشرية في العمل الإبداعي المشترك بين الإنسان والذكاء الاصطناعي.

Nirav Patel, Josiah Crossman, Eva Aggarwal, Emily Wenger2026-08-21
💬 NLP

SynFlow: A Multidimensional Diachronic Semantic Analysis Toolkit

تقدم الورقة البحثية SynFlow، وهي مجموعة أدوات مفتوحة المصدر توحد الأبعاد اللغوية المتنوعة — مثل النحو، والصرف، والأنماط التركيبية — في سير عمل واحد لتمكين التحليل الدلالي التاريخي متعدد الأبعاد والقابل للتفسير، كما هو موضح من خلال دراسة حالة للصفة الألمانية *viral* والتقييم على مهمة SemEval-2020 Task 1.

Bach Phan-Tat, Kris Heylen, Dirk Geeraerts, Stefano De Pascale, Dirk Speelman2026-08-21
💬 NLP

Measuring What a Specification Determines: A Formal Semantic-Block Model and an Execution-Judged Benchmark

يقدم هذا البحث نموذج كتلة دلالية رسمياً ومعياراً تقييمياً محكوماً بالتنفيذ لتقييم جودة المواصفات بشكل مستقل عن قدرة النموذج، موضحاً من خلال دراسة حالة لهجرة من Oracle إلى PostgreSQL أنه بينما يعد الحتمية مفهوماً رسمياً صالحاً، إلا أنها لا تعمل بعد كمعيار جودة تجريبي قائم بذاته للنماذج اللغوية الكبيرة المعاصرة بسبب التباين الكبير في التنفيذ.

Oleg Grynets, Dmytro Kostetskyi, Vasyl Lyashkevych2026-08-21