← Últimos artículos
💬 NLP

PEACE 2.0: Grounded Explanations and Counter-Speech for Combating Hate Expressions

El artículo presenta PEACE 2.0, una herramienta novedosa que utiliza un pipeline de generación aumentada por recuperación (RAG) para explicar las expresiones de odio basándose en evidencia y generar automáticamente contra-discurso fundamentado.

Autores originales: Greta Damo, Stéphane Petiot, Elena Cabrio, Serena Villata

Publicado 2026-02-20
📖 4 min de lectura☕ Lectura para el café

Autores originales: Greta Damo, Stéphane Petiot, Elena Cabrio, Serena Villata

Artículo original bajo licencia CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA del artículo a continuación. No ha sido escrita ni avalada por los autores. Para mayor precisión técnica, consulte el artículo original. Leer descargo de responsabilidad completo

Imagina que internet es una inmensa plaza pública donde la gente habla, comparte ideas y se conecta. El problema es que, a veces, en esa plaza, alguien grita insultos, difunde mentiras dañinas o usa un lenguaje que incita al odio contra otros. Esto es el discurso de odio.

Hasta ahora, los "guardianes" de internet (los algoritmos de Inteligencia Artificial) eran muy buenos haciendo dos cosas:

  1. Detectar el grito: Decir "¡Eh, eso es un insulto!".
  2. Borrar el grito: Eliminar el mensaje.

Pero el problema es que a veces el insulto no es un grito fuerte, sino un susurro con doble sentido (odio implícito), y borrarlo no siempre educa ni cambia la mentalidad de nadie. Además, si solo borramos, no explicamos por qué estaba mal.

Aquí es donde entra PEACE 2.0, una nueva herramienta que actúa como un mediador inteligente y muy bien informado. No solo detecta el problema, sino que te ayuda a entenderlo y te da una respuesta constructiva.

¿Cómo funciona PEACE 2.0? (La analogía del Detective y el Abogado)

Piensa en PEACE 2.0 como un equipo de dos personas trabajando juntas: un Detective y un Abogado.

1. El Detective (Explicación basada en hechos)

Cuando llega un mensaje sospechoso, el Detective no solo dice "esto es malo". Va a la Biblioteca de la Verdad (una base de datos gigante con leyes de derechos humanos y hechos reales) para buscar pruebas.

  • La magia: Si alguien escribe algo sutil que parece inofensivo pero es racista, el Detective busca en la biblioteca un documento que explique por qué esa frase es dañina según las leyes o la historia.
  • El resultado: En lugar de solo decir "es odio", te dice: "Esto es odio porque, según el artículo X de la ONU, este tipo de lenguaje deshumaniza a un grupo específico". Así, la explicación no es una opinión, es un hecho documentado.

2. El Abogado (Generación de "Contra-discurso")

Una vez que el Detective ha encontrado las pruebas, el Abogado entra en acción. Su trabajo no es atacar al agresor, sino convencer a la audiencia y al agresor con la verdad.

  • La estrategia: El Abogado toma las pruebas que encontró el Detective y redacta una respuesta amable pero firme. No dice "eres un tonto", dice: "Entiendo tu frustración, pero los hechos muestran que tu afirmación es incorrecta porque...".
  • La comparación: PEACE 2.0 te permite ver dos versiones de la respuesta: una hecha por la IA "adivinando" (sin libros) y otra hecha con la "Biblioteca de la Verdad" (con RAG). Verás que la versión con libros es mucho más persuasiva, precisa y menos propensa a inventar cosas.

¿Por qué es especial esta versión 2.0?

En la versión anterior, la herramienta era como un espejo: te mostraba el mensaje y te decía si era malo.
En la versión 2.0, la herramienta se convierte en un taller de reparación:

  1. Analiza: Mira el mensaje y te explica por qué duele o por qué es peligroso, citando fuentes reales.
  2. Responde: Genera una respuesta lista para publicar que desafía el odio con datos, no con más odio.
  3. Explora: Tiene un panel de control visual (como un tablero de videojuego) donde puedes ver gráficos de colores que te muestran qué grupos son atacados más a menudo y qué tipo de respuestas funcionan mejor.

El secreto: "RAG" (La mochila de libros)

La tecnología clave se llama RAG (Generación Aumentada por Recuperación).
Imagina que la Inteligencia Artificial es un estudiante muy inteligente pero que a veces se inventa las respuestas (alucinaciones).

  • Sin RAG: El estudiante responde de memoria. Puede estar equivocado.
  • Con RAG (PEACE 2.0): El estudiante tiene una mochila llena de libros de texto oficiales (documentos de la ONU, leyes europeas, etc.). Antes de responder, abre el libro, busca la página correcta y escribe su respuesta basándose en eso.

¿Qué dicen los resultados?

Los autores probaron la herramienta con humanos y máquinas. El resultado fue claro:

  • Las respuestas generadas con la "mochila de libros" (RAG) fueron mucho más convincentes, informativas y lógicas.
  • Funcionaron igual de bien para insultos obvios (gritos) que para insultos sutiles (susurros).
  • La gente las encontró más fáciles de leer y más difíciles de refutar.

En resumen

PEACE 2.0 es como tener un moderador de chat superdotado que nunca se cansa, que siempre lleva consigo una enciclopedia de derechos humanos y que, en lugar de simplemente silenciar a los que odian, les enseña (y nos enseña a nosotros) por qué están equivocados, usando hechos reales para construir un puente en lugar de un muro.

Es una herramienta para hacer de internet un lugar más justo, donde la verdad y la empatía tengan más peso que el odio.

¿Ahogado en artículos de tu campo?

Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.

Probar Digest →