💻 computer science
Condence, Calibration, and Abstention in Small Open-Weight Language Models on Psychiatric Knowledge Questions: A Cross-Domain Replication
تُظهر هذه الدراسة الاستطلاعية أن النماذج اللغوية الصغيرة ذات الأوزان المفتوحة، عند تطبيقها على أسئلة المعرفة النفسية، تُظهر معايرة ثقة ضعيفة، وتصنيفات دقة تعتمد على المجال، وأن حثها على الامتناع عن الإجابة غالباً ما يؤدي إلى تدهور الأداء بدلاً من تحسينه عند تقييمها باستخدام إحصاءات زوجية صارمة.
البحث الأصلي مرخَّص بموجب CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/). هذا شرح مولَّده بالذكاء الاصطناعي للبحث أدناه. لم يكتبه المؤلفون ولم يصادقوا عليه. وللتحقق من الدقة التقنية، يرجى الرجوع إلى البحث الأصلي. اقرأ إخلاء المسؤولية الكامل
غارق في أبحاث مجالك؟
تصلك نشرة يومية بأحدث الأبحاث المطابقة لكلماتك البحثية المفتاحية — مع ملخصات تقنية، بلغتك.