🤖 AI

Geo-Expert: Towards Expert-Level Geological Reasoning via Parameter-Efficient Fine-Tuning

تقدم الورقة البحثية "Geo-Expert"، وهي عائلة من النماذج اللغوية الكبيرة الجيولوجية ذات الكفاءة في المعلمات والمُدربة بدقة على مجموعة بيانات مخصصة، والتي تُظهر قدرات استدلال متخصصة تتفوق على النماذج العامة الأكبر والأنظمة المملوكة مع تقديم حل فعال من حيث التكلفة للذكاء الاصطناه العلمي.

Chenyou Guo, Zongqi Liu, Yizhou Zhang, Zhaorui Jiang, Ze Liu2026-05-26
💬 NLP

Repeated Sequences Reveal Gaps between Large Language Models and Natural Language

تقدم هذه الورقة إطار تقييم مبتكر يعتمد على المتتاليات الفرعية المتكررة وإنتروبيا ريني لإثبات أن النماذج اللغوية الكبيرة الحديثة، وعلى عكس اللغة الطبيعية التي تظهر تنظيماً هيكلياً مستقراً بعيد المدى، تُظهر انحرافات منهجية ومعتمدة على الحجم في أنماط نمو الإنتروبيا لديها، مما يكشف عن فجوات جوهرية في كيفية التقاطها للبنية الإحصائية العميقة للنص بما يتجاوز الطلاقة السطحية.

Kumiko Tanaka-Ishii2026-05-26
🤖 AI

Clustering as Reasoning: A kk-Means Interpretation of Chain-of-Thought Graph Learning

تقترح هذه الورقة إطار عمل KCoT، وهو إطار موحد يفسر تسلسل التفكير (Chain-of-Thought) في الرسوم البيانية المنسوبة للنصوص كعملية تجميع k-means تكرارية، مما يدمج التلقين الدلالي مع المحاذاة الطوبولوجية لتعزيز قدرات الاستدلال والقابلية للتفسير.

Xuanting Xie, Zhaochen Guo, Bingheng Li, Xingtong Yu, Zhifei Liao, Zhao Kang, Yuan Fang2026-05-26
💬 NLP

Towards a Universal Causal Reasoner

تقدم الورقة البحثية UniCo، وهو إطار عمل لتوليد البيانات يقوم بإنشاء بيانات تدريب سببية عالية الجودة ومتنوعة عبر سلم بيرل للسببية (Pearl's Causal Ladder)، مما يعزز بشكل كبير قدرات الاستدلال السببي، والتعميم، والموثوقية للنماذج اللغوية الكبيرة التي تم ضبطها بدقة عبر كل من الاختبارات المعيارية الاصطناعية والتطبيقات الواقعية.

Qirun Dai, Xiao Liu, Jiawei Zhang, Dylan Zhang, Hao Peng, Chenhao Tan2026-05-26
💬 NLP

DTO: a Differentiable Training Objective for Effective Counterfactual Story Rewriting

تقترح هذه الورقة هدف تدريب قابل للتفاضل (DTO) مبتكرًا يستخدم خسارة الانتشار العكسي من الطرف إلى الطرف للتحسين المشترك لكل من دقة المرجع والاتساق الدلالي، مما يعالج بفعالية تحديات التعديلات الموضعية في إعادة كتابة القصص المضادة للواقع ويتفوق على كل من النماذج المرجعية التقلية ونهج التعلم التعزيزي.

Amelia Girard, Massimo Piccardi2026-05-26
💬 NLP

Quantifying the Impact of Translation Errors on Multilingual LLM Evaluation

تبحث هذه الورقة في موثوقية تقييمات النماذج اللغوية الكبيرة متعددة اللغات من خلال إثبات أن أخطاء الترجمة في المعايير المترجمة آلياً تساهم بشكل كبير في انخفاض الدقة، وأن طرق الكشف التلقائي عن الأخطاء تظهر توافقاً غير ضئيل مع التعليقات البشرية.

Klaudia-Doris Thellmann, Bernhard Stadler, Michael Färber, Jens Lehmann2026-05-26
💬 NLP

MultiHaluDet: Multilingual Hallucination Detection via LLM Hidden State Probing

يُعد MultiHaluDet إطار عمل جديداً ثلاثي المراحل وغير مرتبط بلغة محددة، يعمل على كشف الهلوسة متعددة اللغات في النماذج اللغوية الكبيرة المجمدة عبر فحص مسارات الحالة الخفية الكاملة باستخدام بنية انتباه هجينة، محققاً أداءً هو الأفضل في فئته وتعميماً قوياً عبر اللغات ذات الموارد العالية والمتوسطة والمنخفضة دون الحاجة إلى ضبط دقيق خاص بكل لغة.

Riasad Alvi, Nurul Labib Sayeedi, Md. Faiyaz Abdullah Sayeedi2026-05-26
💬 NLP

SEP-Attack: A Simple and Effective Paradigm for Transfer-Based Textual Adversarial Attack

تقترح الورقة البحثية هجوم SEP-Attack، وهو نموذج هجوم نصي جديد يعتمد على النقل ويستفيد من العمليات النقطية المحددّة (Determinantal Point Processes) لتوليد أوزان متنوعة لمجموعات بديلة من أجل تقدير أهمية الكلمات بدقة واختيار أمثلة عدائية عالية القابلية للنقل، متفوقاً بشكل ملحوظ على النماذج المرجعية المتطورة عبر مجموعات بيانات متعددة وواجهات برمجة تطبيقات واقعية.

Han Liu, Zhi Xu, Xiaotong Zhang, Feng Zhang, Xiaoming Xu, Wei Wang, Fenglong Ma, Hong Yu2026-05-26
💬 NLP

Investigating the Interplay between Contextual and Parametric Chain-of-Thought Faithfulness under Optimization

تقدم هذه الورقة البحثية FaithMate، وهو إطار عمل موحد يكشف عن اقتران إيجابي غير متماثل بين الأمانة السياقية والأمانة البارامترية في تسلسل الأفكار (Chain-of-Thought)، مما يثبت أن التحسين من أجل الأمانة البارامترية يعمم بشكل أكثر اتساقاً عبر النماذج المختلفة، مع تسليط الضوء على المقايضات المتأصلة والطبيعة غير المتجانسة لمقاييس الأمانة.

Jingyi Sun, Qianli Wang, Pepa Atanasova, Nils Feldhus, Isabelle Augenstein2026-05-26
💬 NLP

Universal Boosts, Specific Suppressors: Sparse Autoencoder Steering of Medical Vision-Language Models

تقدم هذه الورقة طريقة تعتمد على الاستدلال فقط باستخدام التوجيه المتبقي القائم على المشفر التلقائي المتناثر لتقليل الهلوسة بشكل كبير وتحسين جودة التقارير في النماذج اللغوية الرؤيوية الطبية من خلال تطبيق اتجاهات تعزيز عالمية واتجاهات كبح خاصة بالنموذج، مما يثبت الفعالية عبر بنيات ومجموعات بيانات متعددة دون الحاجة إلى إعادة التدريب.

Farhad Nooralahzadeh, Benjamin Gundersen, Nicolas Deperrois, Hidetoshi Matsuom, Mizuho Nishio, Thomas Frauenfelder, Ahme (…)2026-05-26