← Últimos artículos
🤖 machine learning

Do Neural Networks Really Beat the Curse of Dimensionality? A Bit-Complexity View

Este artículo sostiene que cuando la eficiencia de aproximación se evalúa mediante la complejidad de bits computacional en lugar del recuento de parámetros, ningún método supera fundamentalmente los límites intrínsecos establecidos por la entropía métrica, revelando que las ventajas percibidas de las redes neuronales a menudo derivan de diferencias en la complejidad de la clase de funciones más que de una superioridad arquitectónica, y reformulando la tradicional "maldición de la dimensionalidad" como una "maldición de la complejidad de bits" más fundamental.

Autores originales: Tong Mao, Jinchao Xu

Publicado 2026-08-04
📖 8 min de lectura🧠 Análisis profundo

Autores originales: Tong Mao, Jinchao Xu

Artículo original bajo licencia CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA del artículo a continuación. No ha sido escrita ni avalada por los autores. Para mayor precisión técnica, consulte el artículo original. Leer descargo de responsabilidad completo

Imagina que estás tratando de describir un objeto complejo y de alta dimensionalidad —como una galaxia giratoria o un pastel de múltiples capas— a un amigo que solo puede entender dibujos simples y planos. En el mundo de la informática y las matemáticas, esto se conoce como un "problema de aproximación de alta dimensionalidad". Durante décadas, los científicos han estado luchando contra un enemigo notorio llamado la "maldición de la dimensionalidad". El nombre suena aterrador, pero la idea es simple: a medida que el número de variables (o dimensiones) en un problema crece, la cantidad de información necesaria para describirlo con precisión explota. Es como intentar pintar un cuadro de un objeto de 100 dimensiones; el número de pinceladas requeridas parece crecer tan rápido que resulta imposible terminar el trabajo.

Durante mucho tiempo, la forma estándar de medir qué tan bien resuelve un problema una computadora era contando "parámetros". Piensa en los parámetros como los botones, diales y ajustes de una máquina. Si un método utiliza menos botones para obtener el mismo resultado, se considera más eficiente. Recientemente, las redes neuronales (los sistemas de IA que impulsan cosas como el reconocimiento de imágenes y los modelos de lenguaje) han sido celebradas porque parecen romper esta maldición. Parecen resolver problemas de alta dimensionalidad con un número de botones que no explota a medida que las dimensiones crecen, lo que ha llevado a muchos a creer que han encontrado una llave mágica para desbloquear los problemas más complejos de la ciencia.

Sin embargo, hay un detalle que a menudo se pasa por alto en medio del entusiasmo. En el mundo real, las computadoras no almacenan números con precisión infinita; los almacenan como cadenas de 0s y 1s, o "bits". Cada botón de esa máquina necesita ser codificado en un número específico de bits para poder ser almacenado y calculado. Este artículo plantea una pregunta fundamental: si dejamos de contar solo los botones y empezamos a contar los bits reales de información necesarios para almacenarlos, ¿siguen las redes neuronales pareciendo mágicas? Los autores, Tong Mao y Jinchao Xu, profundizan en esta cuestión, utilizando un concepto llamado "entropía métrica" (que esencialmente mide la cantidad mínima de información necesaria para describir una forma o función) para ver si las redes neuronales realmente vencen la maldición o si solo están ocultando el costo de otra manera.


El gran robo de conteo de bits

Los autores de este artículo, Tong Mao y Jincho Xu, decidieron ponerse sus sombreros de detectives y observar la "maldición de la dimensionalidad" desde un nuevo ángulo. En lugar de simplemente contar cuántos parámetros (botones) utiliza un método, se preguntaron: "¿Cuánta memoria en bits requiere realmente almacenar esos botones y obtener una buena respuesta?".

Para entender su investigación, imagina que estás tratando de describir una colina suave y ondulada a un robot.

  • La forma antigua (Contar parámetros): Podrías decir: "Necesito 100 puntos para describir esta colina". Si cambias a un nuevo método, como una red neuronal, y dices: "Solo necesito 10 puntos", sientes que has ganado. ¡Has vencido a la maldición!
  • La nueva forma (Contar bits): Pero espera. ¿Qué pasa si esos 10 puntos son increíblemente sensibles? ¿Qué pasa si para describir la forma de la colina con precisión, cada uno de esos 10 puntos necesita ser almacenado con una precisión extrema, como necesitar 1,000 bits para cada punto? De repente, no estás usando 10 unidades de información; estás usando 10,000. Mientras tanto, el método "antiguo" usaba 100 puntos, pero cada uno solo necesitaba 10 bits. Al final, el método "antiguo" en realidad utilizó menos bits totales.

El artículo argumenta que durante mucho tiempo hemos sido engañados por el "conteo de parámetros". Vimos a las redes neuronales usar menos botones y asumimos que eran más eficientes. Pero cuando los autores midieron la eficiencia en términos de bits (la moneda real de la computación), la historia cambió.

La "magia" que no es tan mágica

Los investigadores analizaron dos tipos principales de "magia" por las que las redes neuronales eran famosas:

  1. Tasas independientes de la dimensión: Algunos estudios afirmaban que las redes neuronales podían aproximar ciertas funciones complejas sin que su rendimiento empeorara a medida que aumentaba el número de dimensiones. Parecía que habían encontrado una forma de ignorar por completo el tamaño del problema.
  2. Superconvergencia: Esta es la idea de que las redes neuronales profundas (redes con muchas capas) pueden aproximar funciones suaves mucho más rápido que los métodos tradicionales como los polinomios o los elementos finitos. Parecía que estaban pasando de largo a la competencia.

La investigación de los autores reveló que estas "superpoderes" son en gran medida una ilusión creada por la forma en que medimos las cosas.

Cuando analizaron la entropía métrica —un término sofisticado para la complejidad intrínseca de la clase de funciones que se está aproximando— descubrieron que las funciones que las redes neuronales son buenas aproximando (como las de los "espacios de Barron") son en realidad solo más simples que las funciones con las que los métodos tradicionales tienen dificultades. No es que la red neuronal sea un mejor artista; es que la pintura que se le pide copiar tiene menos detalles que la que el artista tradicional estaba intentando copiar. La velocidad "independiente de la dimensión" no es porque la red sea especial; es porque el objetivo era fácil desde el principio.

La trampa de las redes profundas

El hallazgo más sorprendente se refiere a las redes neuronales profundas. Estas son las redes con muchas capas que han estado recibiendo todo el bombo publicitario. El artículo muestra que, si bien las redes profundas pueden de hecho lograr una tasa de error más rápida cuando se mide por el número de parámetros (los "botones"), esta velocidad viene con un impuesto oculto.

Debido a que las redes profundas son tan compleas y sensibles, los números dentro de ellas (los pesos y sesgos) necesitan ser almacenados con una precisión mucho mayor para evitar errores. Los autores demostraron que el número de bits necesarios para almacenar estos parámetros crece de forma explosiva a medida que la red se hace más profunda.

Piénsalo de esta manera: una red poco profunda es como un puente de madera robusto. Requos muchos tablones (parámetros), pero cada tablón es fácil de medir y almacenar. Una red profunda es como un puente de cristal. Utiliza menos tablones, pero cada tablón es tan frágil y preciso que necesitas un escáner láser para medirlo. Si intentas construir el puente de cristal con una cinta métrica estándar (precisión finita), se derrumba.

El artículo demuestra que cuando cuentas el total de bits necesarios para construir ese puente de cristal, la "eficiencia" desaparece. Los bits adicionales necesarios para mantener la estabilidad de la red profunda cancelan la ventaja de tener menos parámetros. De hecho, para muchos problemas estándar, las redes profundas terminan requiriendo tantos bits, o incluso más, que los métodos clásicos como los polinomios o los elementos finitos.

El veredicto: Es un poco de una maldición

Entonces, ¿vencen las redes neuronales a la maldición de la dimensionalidad? Según Mao y Xu, la respuesta es no, al menos no de la manera en que pensábamos.

La "maldición" no se trata realmente del número de dimensiones. Se trata de la complejidad de los bits. El límite fundamental de qué tan bien puedes aproximar una función está determinado por cuánta información (bits) contiene realmente esa función. Esto está gobernado por la "entropía métrica".

  • Si una función es compleja, requiere muchos bits para ser descrita, sin importar qué herramienta utilices.
  • Si una función es simple, requiere menos bits.

Las redes neuronales no cambian las reglas del juego; solo cambian la forma en que cuentan la puntuación. Cuando miramos el juego a través del lente de los bits en lugar de los parámetros, la "superioridad" de las redes neuronales a menudo desaparece. Las ventajas aparentes, como las tasas independientes de la dimensión o la superconvergencia, son a menudo solo porque las redes neuronales están siendo probadas en clases de funciones que son inherentemente menos complejas (tienen una entropía métrica menor) que aquellas en las que se prueban los métodos tradicionales.

Por qué esto es importante

Este artículo no dice que las redes neuronales sean inútiles. Dice que debemos ser más inteligentes sobre cómo las evaluamos. En el mundo real, las computadoras tienen memoria finita. No pueden almacenar una precisión infinita. Si un método parece excelente en el papel porque usa menos parámetros, pero requiere una cantidad masiva de memoria para almacenar esos parámetros con precisión, podría no ser la mejor opción para una aplicación del mundo real.

Los autores sugieren que la "maldición de la dimensionalidad" es en realidad una "maldición de la complejidad de los bits". El límite real no es cuántas dimensiones tienes, sino cuántos bits necesitas para describir el problema. Al cambiar nuestro enfoque de contar botones a contar bits, obtenemos una imagen mucho más clara y realista de lo que estas poderosas herramientas pueden y no pueden hacer. Es un recordatorio de que, en el mundo de las matemáticas de alta dimensionalidad, el diablo siempre está en los detalles... y esos detalles se miden en bits.

¿Ahogado en artículos de tu campo?

Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.

Probar Digest →