💬 NLP

RAG-Based Auto-Configuration for Industrial Fieldbus Devices

تقدم هذه الورقة "SysName"، وهو مسار عمل (pipeline) للبحث المعزز بالتوليد (RAG) موجه للإنتاج، يقوم بأتمتة التكوين الشامل لأجهزة ناقل المجال الصناعي (industrial fieldbus) من خلال الجمع بين الاسترجاع الهجين ونموذج لغوي كبير محلي معزز بالأنطولوجيا وبوابة سلامة صارمة متعددة المراحل لتحقيق دقة عالية وصفر عمليات كتابة غير آمنة.

Aadil Gani Ganie, Saad Ezzini, Naveed Farooz Marazi2026-08-11
💰 quantitative finance

Can Open-Weight Models Compete on Financial Text Comprehension?

تقيم هذه الورقة معايير "Financial Touchstone" المحدثة باستخدام عشرين نموذجاً، كاشفةً أن النماذج ذات الأوزان المفتوحة مثل "Kimi K2.6" يمكنها منافسة الأنظمة المملوكة في فهم النصوص المالية رغم استمرار اختناقات استرجاع المعلومات وسلوكيات الرفض الجيوسياسية غير المتسقة في النماذج الصينية.

Jan Spörer2026-08-11
💬 NLP

Enhancing Scientific Named Entity Recognition via Large Language Models: A Type-driven Multi-task Learning Approach

تقدم هذه الورقة البحثية TdSciNER، وهو إطار عمل للتعلم متعدد المهام قائم على النوع يعزز التعرف على الكيانات المسماة العلمية من خلال تصفية أنواع الكيانات المرشحة، ودمج مهمة تصنيف مساعدة للحصول على تمثيلات أكثر ثراءً، واستخدام استراتيجية مبتكرة لاختيار النماذج التوضيحية لتحسين أداء النماذج اللغوية الكبيرة عبر مختلف المجالات العلمية.

Tong Bao, Yi Zhao, Heng Zhang, Chengzhi Zhang2026-08-11
💬 NLP

The Evolution of Mixture-of-Experts Architectures in Large Language Models: Routing, Topology, Load Balancing, and Expert Parallelism

تُجمّع هذه الدراسة التقنية تطور بنيات "خليط الخبراء" (Mixture-of-Experts) في النماذج اللغوية الكبيرة عبر تنظيمها في رسم بياني للتبعية وتحليلها من خلال أربعة مستويات تحكم (طوبولوجيا الخبراء، التوجيه، التوازن، وتوازي الخبراء) لتوضيح تحول المجال من مجرد تفعيل المعلمات المتفرقة نحو فك الارتباط بين التوجيه الدلالي، والميزانيات الحسابية، والتنفيذ الفيزيائي.

Jiguo Li2026-08-11
💬 NLP

Can We Optimize the Performance-Carbon Emission Break-Even Point?: The Quest for Greener LLMs

تقترح هذه الأبحاث الجارية طريقة ضبط دقيق واعية بالكربون تدمج بديل طاقة قابلاً للتفاضل في دالة الخسارة لتحديد منطقة "نقطة التعادل" المعتمدة على النموذج والمهمة، حيث يمكن للنماذج اللغوية الكبيرة تحقيق دقة محسنة في المهمة مع انبعاثات كربونية إضافية معدومة أو تقترب من الصفر.

Sourav Das, Tanmay Joshi, Kripabandhu Ghosh2026-08-11
💬 NLP

Unsure but Certain: Uncovering the Representation-Confidence Gap in Diffusion Language Models

تحدد هذه الورقة البحثية "فجوة تمثيل-ثقة" في نماذج الانتشار اللغوية، حيث يتم تجاهل إشارات الكشف عن الخطأ الداخلية من قبل درجات الثقة الخارجية في ظل الظروف الصاخبة، ولكنها تثبت أن أداة خفيفة الوزن ولا تتطلب توليدًا يمكنها استخراج هذه الإشارات الخفية لاستعادة ترتيب الإجابات دون تعديل النموذج الأساسي.

Saurabh Yadav, Badri Narayana Patro, Vijay Srinivas Agneeswaran2026-08-11
💬 NLP

Toward Metacognitive One-Shot Indirect Prompt Injection: Strategy Abstraction Via Outcome-Conditioned Reflection

تقدم الورقة البحثية إطار عمل SAVOR، وهو إطار عمل مبتكر يتيح حقن الأوامر غير المباشر أحادي الخطوة القائم على الميتا-معرفة (metacognitive) ضد وكلاء النماذج اللغوية الكبيرة (LLM agents)، وذلك عبر استخلاص استراتيجيات هجوم قابلة لإعادة الاستخدام من التأمل غير المتصل (offline reflection) في مسارات متنوعة، مما يحقق معدلات نجاح فائقة في سيناريوهات الاستعلام الواحد دون الحاجة إلى تغذية راجعة من الهدف.

Sihan Hou, Xinmeng Hou, Zhijun Zhang, Zehao Wang, Xuhong Ren, Sibo Qin, Kuntharrgyal Khysru, Qing Guo2026-08-11
💬 NLP

IDRAAK: From Multi-Agent NLP to Few-Shot Prompting for Semantic Drift Detection in Technical Requirements

تقدم الورقة البحثية إطار عمل IDRAAK، وهو إطار عمل قابل للتفسير للكشف عن الانزياح الدلالي في المتطلبات التقنية عبر اللغات، مظهرةً أن نهج التلقين بلقطات قليلة بسيط مع استدعاء واحد لنموذج لغوي كبير يتفوق على البدائل الأكثر تعقيداً والمتعددة الوكلاء والمهيكلة، مع تحقيق دقة وكفاءة عاليتين.

Shiva Ahir2026-08-11
💬 NLP

Tevatron-Elastic: A Unified Abstraction for Training Elastic Retrievers and Rerankers

تقدم الورقة البحثية Tevatron-Elastic، وهو إطار عمل موحد يتيح تدريب نموذج واحد قائم على المحولات (transformer) قادر على التكيف ديناميكيًا مع أحجام مختلفة لكل من المسترجعات (retrievers) وأعيدي التصنيف (rerankers) عن طريق الجمع بين تقليل الطبقات، وضغط الرموز (token compression)، واقتطاع التضمين (embedding truncation) تحت تجريد بسيط، مما يوفر مقايضات نشر مرنة دون الحاجة إلى إعدادات تدريب منفصلة لكل تكوين.

Yu Wang, Shengyao Zhuang, Xueguang Ma, Zongyu Wu, Jimmy Lin, Vivek Srikumar, Zhichao Xu2026-08-11
💬 NLP

Conversation as Measurement in Clinical Encounters: Observable Phase Structure, Partially Observable Patient State

تتقصى هذه الورقة مدى إمكانية ملاحظة حالة المريض وبنية مراحل المحادثة في اللقاءات السريرية باستخدام 439 نصاً وبيانات تقارير النتائج المعتمدة على تقييم المريض (PROM)، حيث وجدت أنه بينما يمكن ملاحظة بنية المراحل بشكل موثوق من النصوص، تظل حالة المريض قابلة للاسترداد جزئياً فقط، مما يسلط الضوء على حدود استنتاج الحالة البشرية من المحادثة وحدها.

Lily Chen, Ted Mau, Michael Gensheimer, Brian Anthony Nuyen, Nancy Jiang, James Zou2026-08-11