Automated auditing of statistical quality in university theses: why lexical rules fail and what a language layer adds
Cette étude démontre que l'audit automatisé fondé sur des règles de la qualité statistique des thèses universitaires est moins performant que le hasard en raison de limitations lexicales fondamentales, mais l'intégration d'une couche de modèle de langage améliore considérablement la concordance avec le jugement d'experts tout en maintenant un rappel élevé et un coût faible.