Navigating the Prompt Space: Improving LLM Classification of Social Science Texts Through Prompt Engineering
本文表明,虽然系统地改变提示工程元素(如标签描述、指令引导和少样本示例)可以显著提高大语言模型对社会科学文本的分类准确率,但性能提升在超过最小限度的上下文增加后往往是微乎其微的,有时会随着上下文过多而下降,并且在不同模型和任务之间存在实质性差异,因此需要进行个体验证,而非依赖通用规则。