Systematic evaluation and benchmarking of text summarization methods for biomedical literature: From word-frequency methods to language models
本論文は、1,000件の生物医学的抄録を用いて62種類のテキスト要約手法をベンチマークしており、汎用的な中規模言語モデルが、統計的な抽出型手法や特化型あるいはフロンティア規模のモデルよりも、正確で意味的に一貫した科学的要約を生成する上で優れていることを明らかにしている。