Safety and accuracy follow different scaling laws in clinical large language models
تقدم الورقة إطار عمل SaFE-Scale ومعيار RadSaFE-200 لإثبات أن سلامة النماذج اللغوية الكبيرة السريرية ليست نتاجاً سلبياً لعملية التوسع، بل هي خاصية تعتمد على عملية النشر حيث تساهم الأدلة عالية الجودة بشكل كبير في تقليل الأخطاء الخطيرة، في حين تفشل عمليات الاسترجاع القياسية وزيادة الحوسبة في تكرار مكاسب السلامة هذه.