💻 computer science
Condence, Calibration, and Abstention in Small Open-Weight Language Models on Psychiatric Knowledge Questions: A Cross-Domain Replication
这项初步研究表明,应用于精神医学知识问题的轻量级开源权重语言模型表现出较差的置信度校准能力、具有领域依赖性的准确率排名,并且在经过严格的配对统计评估时,提示其放弃回答往往会降低而非提高性能。
原始论文采用 CC BY 4.0 许可(https://creativecommons.org/licenses/by/4.0/)。 这是对下方论文的AI生成解释。它不是由作者撰写或认可的。如需技术准确性,请参阅原始论文。 阅读完整免责声明
您所在领域的论文太多了?
获取与您研究关键词匹配的最新论文每日摘要——附技术摘要,使用您的语言。