💬 NLP

Do LLMs Really Know What They Don't Know? Internal States Mainly Reflect Knowledge Recall Rather Than Truthfulness

تجادل هذه الورقة بأن الحالات الداخلية للنماذج اللغوية الكبيرة تعكس في المقام الأول استرجاع المعرفة البارامترية بدلاً من صدق المخرجات، مبرهنةً على أن الهلوسة المدفوعة بالارتباطات الإحصائية الزائفة لا يمكن تمييزها آلياً عن الاستدعاء الحقائقي، مما يحد من فعالية طرق الكشف القياسية.

Chi Seng Cheang, Hou Pong Chan, Wenxuan Zhang, Yang Deng2026-03-09
🤖 AI

Just-In-Time Objectives: A General Approach for Specialized AI Interactions

تقدم هذه الورقة "الأهداف في الوقت المناسب" (Just-In-Time Objectives)، وهو إطار عمل يراقب سلوك المستخدم بشكل سلبي لاستنتاج أهداف محددة في الوقت الفعلي وتحسينها بسرعة، مما يمكّن النماذج اللغوية الكبيرة من توليد أدوات واستجابات متخصصة تتفوق بشكل كبير على التفاعلات العامة القياسية.

Michelle S. Lam, Omar Shaikh, Hallie Xu, Alice Guo, Diyi Yang, Jeffrey Heer, James A. Landay, Michael S. Bernstein2026-03-09
💬 NLP

Chain-of-Thought Reasoning Improves Context-Aware Translation with Large Language Models

تُظهر هذه الورقة أن التفكير المتسلسل (chain-of-thought) يعزز بشكل كبير قدرة النماذج اللغوية الكبيرة على التعامل مع التبعات بين الجمل في الترجمة من الإنجليزية إلى الفرنسية، حيث حققت النماذج الأعلى أداءً مثل GPT-4 وPhi دقة عالية وأظهرت تأثير "الحكيم يزداد حكمة" حيث يستفيد النماذج القوية بالفعل من التفكير بشكل أكبر.

Shabnam Ataee, Hugo Huart, Andrei Popescu-Belis2026-03-09
🤖 AI

Automated Coding of Communication Data Using ChatGPT: Consistency Across Subgroups

تُظهر هذه الدراسة أن الترميز القائم على ChatGPT لبيانات التواصل يؤدي بشكل متسق عبر المجموعات الفرعية للجنس والعرق/الإثنية، مما يطابق موثوقية المقيم البشري ويؤكد إمكاناته للتقييمات التعاونية واسعة النطاق.

Jiangang Hao, Wenju Cui, Patrick Kyllonen, Emily Kerzabi2026-03-09
💬 NLP

DETECT: Determining Ease and Textual Clarity of German Text Simplifications

تقدم هذه الورقة البحثية DETECT، وهو أول مقياس مخصص للغة الألمانية لتقييم التبسيط التلقائي للنصوص، والذي تم تدريبه على بيانات اصطناعية ناتجة عن نماذج لغوية كبيرة (LLM) وتم التحقق من صحته باستخدام مجموعة بيانات ضخمة موسومة بشرياً، مما أظهر ارتباطاً فائقاً مع الأحكام البشرية عبر معايير البساطة، والحفاظ على المعنى، والطلاقة مقارنة بالمقاييس العامة الحالية.

Maria Korobeynikova, Alessia Battisti, Lukas Fischer, Yingqiang Gao2026-03-09
💬 NLP

AfriMTEB and AfriE5: Benchmarking and Adapting Text Embedding Models for African Languages

تقدم هذه الورقة البحثية AfriMTEB، وهو معيار مرجعي شامل يغطي 59 لغة أفريقية عبر 14 مهمة و38 مجموعة بيانات، إلى جانب AfriE5، وهو نموذج لتمثيل النصوص (text embedding) متطور تم تكييفه لهذه اللغات من خلال التقطير التبايني عبر اللغات.

Kosei Uemura, Miaoran Zhang, David Ifeoluwa Adelani2026-03-09
💬 NLP

Activation-Space Personality Steering: Hybrid Layer Selection for Stable Trait Control in LLMs

تقترح هذه الورقة إطار عمل هجينًا جديدًا لاختيار الطبقات يستخرج سمات الشخصية الخمس الكبرى من الحالات المخفية للنماذج اللغوية الكبيرة عبر اكتشاف الفضاء الجزئي منخفض الرتبة لتمكين التوجيه السلوكي المستقر والدقيق دون المساس بالطلاقة أو القدرات العامة.

Pranav Bhandari, Nicolas Fay, Sanjeevan Selvaganapathy, Amitava Datta, Usman Naseem, Mehwish Nasim2026-03-09
💬 NLP

Critical Confabulation: Can LLMs Hallucinate for Social Good?

تقترح هذه الورقة "التلفيق النقدي"، وهو إطار عمل يتم فيه توجيه النماذج اللغوية الكبيرة لتوليد سرديات تخمينية مقيدة بالأدلة لملء الفجوات الأرشيفية المتعلقة بالشخصيات التاريخية المهمشة، مما يوضح أن الهلوسة المنضبطة يمكن أن تدعم إنتاج المعرفة الأخلاقية دون التضحية بالأمانة التاريخية.

Peiqi Sui, Eamon Duede, Hoyt Long, Richard Jean So2026-03-09
🤖 machine learning

SPINE: Token-Selective Test-Time Reinforcement Learning with Entropy-Band Regularization

تقترح الورقة البحثية إطار عمل SPINE، وهو إطار للتعلم التعزيزي أثناء وقت الاختبار يعتمد على اختيار الرموز (tokens)، والذي يعمل على تحسين أداء نماذج الاستدلال من خلال تحديث الرموز الحرجة في اتخاذ القرار ذات الإنتروبيا العالية فقط باستخدام تنظيم نطاق الإنتروبيا، مما يمنع انهيار الاستجابة ويعزز الاستقرار دون الحاجة إلى تسميات خارجية أو نماذج مكافأة.

Jianghao Wu, Yasmeen George, Jin Ye, Yicheng Wu, Daniel F. Schmidt, Jianfei Cai2026-03-09
🤖 AI

Window-based Membership Inference Attacks Against Fine-tuned Large Language Models

تقدم هذه الورقة البحثية هجوم WBC (المقارنة القائمة على النافذة)، وهو هجوم استدلال عضوية مبتكر يتفوق بشكل كبير على أساليب المتوسط العالمي الحالية ضد النماذج اللغوية الكبيرة المضبوطة بدقة، وذلك من خلال استغلال إشارات الحفظ الموضعية عبر نهج النافذة المنزلقةة مع التجميع القائم على الإشارة.

Yuetian Chen, Yuntao Du, Kaiyuan Zhang, Ashish Kundu, Charles Fleming, Bruno Ribeiro, Ninghui Li2026-03-09