Apparent sequence-model contribution depends strongly on negative-set construction: a calibration across 94 ENCODE eCLIP datasets
Cette étude démontre que la contribution estimée des modèles de séquence pour les protéines de liaison à l'ARN varie considérablement selon la méthode de construction de l'ensemble négatif et la référence utilisée, incitant les chercheurs à adopter le cross-fitting, à rapporter la performance uniquement sur la composition et à éviter de comparer des contributions dérivées de différents protocoles d'ensembles négatifs.