Systematic evaluation and benchmarking of text summarization methods for biomedical literature: From word-frequency methods to language models
Dit artikel benchmarkt 62 methoden voor tekstsamenvatting op 1.000 biomedische abstracts, waarbij wordt onthuld dat algemene, middelgrote taalmodellen zowel statistische extractieve methoden als gespecialiseerde of frontier-schaal modellen overtreffen in het genereren van nauwkeurige en semantisch coherente wetenschappelijke samenvattingen.