What AI Red-Team Evaluations Can and Cannot Prove
تضع هذه الورقة "سقفاً استدلالياً" قابلاً للحساب لتقييمات الفرق الحمراء للذكاء الاصطناعي، حيث تثبت أنه في حين يمكن للمعايير المرجعية الحالية أن تصادق بفعالية على السلامة فيما يتعلق بالأضرار عالية التكرار، إلا أنها غير كافية جوهرياً لإثبات السلامة تجاه المخاطر الكارثية النادرة بسبب القيود الإحصائية المتأصلة.