💬 NLP

Mind2Report: Expert-Level Commercial Report Synthesis via Cognitive Deep Research Agent

تقدم الورقة البحثية Mind2Report، وهو وكيل بحث عميق معرفي يحاكي المحللين التجاريين لتوليد تقارير بمستوى الخبراء من خلال استقصاء النوايا دقيق التفاصيل، والتقطير المتكرر للأدلة، وصقل المخطط التفصيلي المتطور بشكل مشترك، مما يظهر أداءً فائقاً على معيار QRC-Eval المستحدث مقارنة بوكلاء البحث العميق الحاليين.

Mingyue Cheng, Daoyu Wang, Qi Liu, Shuo Yu, Xiaoyu Tao, Yuqian Wang, Chengzhong Chu, Yu Duan, Mingkang Long, Enhong Chen2026-08-27
💬 NLP

Just Pass Twice: Efficient Token Classification with LLMs for Zero-Shot NER

تقترح الورقة البحثية طريقة "المرور مرتين فقط" (JPT)، وهي وسيلة تمكّن النماذج اللغوية الكبيرة السببية من أداء التعرف على الكيانات المسماة بأسلوب الصفر المعرفة بكفاءة ومستوى رائد، وذلك عبر دمج النص المدخل للسماح بسياق ثنائي الاتجاه كامل دون تغييرات هيكلية، مما يتغلب على قيود التوليد ذاتي الانحدار مع تحقيق سرعة استدلال تزيد عن 20 ضعفاً.

Ahmed Ewais, Ahmed Hashish, Amr Ali2026-08-27
💬 NLP

VDAR-Router: Adaptive LLMs Routing via Verbalized Query Difficulty Analysis Retrieval

يُعد VDAR-Router إطار عمل استرجاعي يعتمد على الوعي بالصعوبة ولا يتطلب تدريبًا، حيث يعمل على تحسين كفاءة توجيه النماذج اللغوية الكبيرة من خلال توليد تحليلات صريحة لصعوبة الاستعلام لاسترجاع أمثلة تاريخية مماثلة، مما يؤدي إلى تحسين المقايضة بين التكلفة والأداء في اختيار النماذج.

Yu-Chien Tang, Jun-Chen Hung, Wen-Chih Peng, An-Zi Yen2026-08-27
💻 computer science

Natural Language Input, Semantic Track Representation, and LLM Inference: Making the Maritime Information Exchange Model Tractable

تقترح هذه الورقة بنية عملية تسخر النماذج اللغوية الكبيرة لترجمة ملاحظات المشغلين باللغة الطبيعية إلى سجلات تأكيد دلالية مهيكلة لتراكم واستنتاج الرسوم البيانية للمعرفة، مما يلغي الحاجة إلى خبرة في الأنطولوجيا الرسمية ويجعل نموذج تبادل المعلومات البحرية قابلاً للنشر الفوري لأغراض الدفاع وإنفاذ القانون.

Frederick Roth2026-08-27
💬 NLP

Detection != Reliable Control: Decodable Empathy Directions Yield at Most Partial Shifts in Automated Empathy Scores

تُظهر هذه الورقة أنه بينما يمكن لاتجاهات التعاطف القابلة للفك في النماذج اللغوية الكبيرة المضبوطة بالتعليمات أن تكتشف بشكل موثوق وتغير جزئياً درجات التعاطف الآلية، إلا أنها لا تشكل روافع سببية موثوقة للتحكم الشامل، لا سيما بفشلها في إحداث تغييرات ملموسة يدركها البشر أو تأثيرات متسقة عبر مختلف جوانب التعاطف والنماذج المختلفة.

Haoran Jisun2026-08-27
💻 computer science

PA-CoT: Profile-Adaptive Chain-of-Thought for Personalized Nutritional Consulting

تقدم الورقة البحثية PA-CoT، وهي طريقة تحفيز متعددة المراحل تقوم بتحليل ملفات تعريف المستخدمين بشكل صريح قبل إنشاء الاستجابات، والتي تتفوق على 11 نهجاً حالياً في مقياس QPA الجديد من خلال تحسين كل من التخصيص والسلامة بشكل كبير في مجال الاستشارات الغذائية.

Evgenii Garmashov, Nikita Kulin, Artur Khairullin, Viktor Zhuravlev, Daniil Sukhorukov, Mikhail Mozikov, Ilya Makarov, S (…)2026-08-27
💬 NLP

Semantic Variability of Replies Across LLMs: Implications for Designing Conversation-Based Assessment

تُظهر هذه الدراسة أن اختيار النموذج اللغوي الكبير والسياق الحواري يؤثران بشكل كبير على الاتساق الدلالي للردود المُولَّدة، مما يشير إلى أن استراتيجيات التلقين الحالية غير كافية لضمان استجابات مستقرة وقابلة للمقارنة عبر النماذج المختلفة في التقييمات القائمة على المحادثة.

Jiangang Hao2026-08-27
🤖 machine learning

GreenLeaf Law Embed Tiny: A Compact Embedding Model for Legal Domain Retrieval

تقدم الورقة البحثية نموذج GreenLeaf Law Embed Tiny، وهو نموذج تضمين مدمج بـ 0.6 مليار معلمة يحقق أداءً تنافسياً في استرجاع النصوص القانونية من خلال مسار تقطير وضبط دقيق يتكون من مرحلتين، ومجموعة بيانات منسقة تضم 3.4 مليون زوج من الاستعلامات والمقاطع، وبنية فعالة محسنة للبيئات محدودة الموارد.

Surya Saka2026-08-27
💬 NLP

The Dialect Tax: Dialectal Biases Persist throughout the Language Modeling Pipeline

تُثبت هذه الورقة أن "ضريبة اللهجة" —وهي فجوات الأداء المنهجية بين اللغة الإنجليزية الأمريكية القياسية واللهجات الأخرى في النماذج اللغوية— لا تنتج عن مرحلة واحدة، بل تتراكم طوال مسار النمذجة بأكمله، بدءاً من التجزئة (tokenization) والتدريب المسبق، وصولاً إلى ما بعد التدريب والاستدلال.

Elle2026-08-27
💻 computer science

Retrieved But Not Reliable: A Survey on Attacks, and Defenses in Retrieval-Augmented Generation

تقدم هذه الدراسة المسحية نظرة عامة موحدة ومدركة لمراحل العمل (pipeline-aware) حول متانة التوليد المعزز بالاسترجاع (RAG) من خلال صياغة نماذج التهديد، وتصنيف الهجمات إلى أهداف تتعلق بالدقة والخصوصية والعدالة، ومراجعة الدفاعات الخاصة بكل مرحلة، والمعايير المرجعية، وطرق التفسيرية.

Minh Tran, Cuong Dang, Tuc Nguyen, Khanh-Tung Tran, Minh Huynh Nguyen, Trinh Chau, Kien Le, Do Xuan Long, Jiahao Zhang (…)2026-08-27