Can AI Guess What You Know? Performance Comparison of Large Language Models for Human Domain Knowledge Estimation From Communication Logs
تقيم هذه الدراسة قدرة سبعة نماذج لغوية كبيرة على استنتاج المعرفة بالمجال الفردي من سجلات اتصالات "سلاك" عبر مقارنة تقديراتها في وضع الصفر (zero-shot) بالمهارات المبلغ عنها ذاتياً، لتجد أنه بينما حقق نموذج "Gemini 2.5 Flash" أعلى دقة، فإن أداء الاستنتاج يعتمد بشكل ضعيف فقط على حجم الرسائل، مما يسلط الضوء على الحاجة إلى نهج يحافظ على الخصوصية ويهتم بالهيكلية.