Context-Aware LLM Evaluators for Content Moderation Judgments in a Low-Resource Setting
Este estudio demuestra que, si bien el uso de prompts conscientes del contexto y la recuperación de decisiones previas puede mejorar los evaluadores de modelos de lenguaje de gran tamaño para la moderación de foros de periódicos alemanes, la elección de la capacidad del modelo es más crítica que la estrategia de prompting, siendo el modelo más grande el que supera a los sistemas supervisados en categorías de eliminación poco comunes sin requerir datos de entrenamiento anotados.