← Últimos artículos
💬 NLP

Stochasticity in Tokenisation Improves Robustness

Este artículo demuestra que entrenar modelos de lenguaje con tokenización estocástica mejora significativamente su robustez frente a perturbaciones adversarias y aleatorias sin comprometer la precisión ni aumentar los costos de inferencia.

Autores originales: Sophie Steger, Rui Li, Sofiane Ennadir, Anya Sims, Arno Solin, Franz Pernkopf, Martin Trapp

Publicado 2026-04-20
📖 4 min de lectura☕ Lectura para el café

Autores originales: Sophie Steger, Rui Li, Sofiane Ennadir, Anya Sims, Arno Solin, Franz Pernkopf, Martin Trapp

Artículo original bajo licencia CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA del artículo a continuación. No ha sido escrita ni avalada por los autores. Para mayor precisión técnica, consulte el artículo original. Leer descargo de responsabilidad completo

Imagina que los Grandes Modelos de Lenguaje (como los que impulsan a ChatGPT o a ti mismo) son como chefes de cocina extremadamente talentosos, pero con un problema muy peculiar: son obsesivos con la forma en que cortan los ingredientes.

En el mundo de la inteligencia artificial, antes de que un modelo pueda "leer" una frase, debe romperla en trocitos más pequeños llamados "tokens". Normalmente, esto se hace de una sola manera fija y predecible, como si el chef siempre cortara una manzana exactamente en el mismo lugar, sin importar si la fruta está un poco torcida o si alguien la empuja.

El problema:
Si un hacker (un "malvado") empuja ligeramente la manzana o la corta en un lugar diferente (aunque la fruta siga siendo la misma), el chef obsesivo se confunde por completo. Se vuelve frágil. Un pequeño cambio en cómo se escriben las palabras puede hacer que el modelo diga tonterías o revele secretos que no debería. Es como si un chef se negara a cocinar porque alguien puso la sal en un plato diferente al habitual.

La solución del papel: "El Corte Aleatorio"
Los autores de este estudio proponen una idea genial: enseñar al chef a cortar los ingredientes de muchas formas diferentes durante la práctica.

En lugar de entrenar al modelo con una sola forma de cortar las palabras (la "canónica"), les enseñan a aceptar muchas variaciones aleatorias de cómo se pueden dividir las mismas palabras.

La analogía de la "Biblioteca de Caminos"

Imagina que tienes que llegar a una ciudad llamada "Amor".

  • El modelo antiguo (Determinista): Solo conoce un camino: Calle A -> Calle B -> Plaza C. Si alguien bloquea la Calle A, el modelo se queda paralizado y no sabe qué hacer.
  • El nuevo modelo (Estocástico): Durante su entrenamiento, se le ha enseñado a recorrer la ciudad por cientos de caminos diferentes. A veces toma Calle X, a veces Calle Y, a veces Calle Z, pero todos llevan a "Amor".

Cuando un atacante intenta bloquear un camino (una "perturbación" o ataque adversario), el nuevo modelo no entra en pánico. Simplemente dice: "Ah, este camino está bloqueado. No pasa nada, ya conozco otros 50 caminos que también llegan a la misma ciudad".

¿Qué descubrieron los científicos?

  1. La aleatoriedad es fuerza: Al entrenar al modelo con estas "variaciones aleatorias" (llamadas tokenización estocástica), el modelo se vuelve mucho más robusto. Ya no se rompe cuando alguien intenta engañarlo cambiando ligeramente cómo se escriben las palabras.
  2. No es solo "cualquier" aleatoriedad: Descubrieron que no basta con cortar al azar de cualquier manera. Deben ser cortes justos y variados (como un dado bien equilibrado). Si la aleatoriedad está sesgada (siempre corta de la misma manera "rara"), el modelo sigue siendo vulnerable. Necesita ver todas las posibilidades posibles de forma equitativa.
  3. Funciona en todas las etapas: Esto funciona tanto si entrenas al modelo desde cero (pre-entrenamiento) como si le das un "tuneo" final (fine-tuning) para tareas específicas.
  4. Sin costo extra: Lo mejor de todo es que, una vez entrenado, el modelo no necesita hacer más cálculos ni gastar más energía para ser robusto. Es como si el chef hubiera aprendido a cocinar de muchas formas, pero cuando llega el cliente, cocina igual de rápido, solo que ahora no se equivoca si el cliente cambia el pedido un poco.

En resumen

Este papel nos dice que para hacer a la Inteligencia Artificial más segura y resistente a los ataques, no debemos ser tan rígidos. Debemos enseñarles a ser flexibles y adaptables desde el primer día, permitiéndoles ver el mundo (las palabras) desde múltiples perspectivas.

Es como enseñar a un niño a andar en bicicleta no solo en una pista recta y perfecta, sino en terrenos con baches, curvas y viento. Cuando llega el momento de la carrera real (el mundo real con sus ataques), el niño no se cae porque ya ha practicado para todo.

La lección clave: La rigidez hace frágil; la diversidad en el entrenamiento hace fuerte.

¿Ahogado en artículos de tu campo?

Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.

Probar Digest →