Embedded Universal Predictive Intelligence: a coherent framework for multi-agent learning
Este artículo introduce un marco matemático para la inteligencia predictiva universal embebida que extiende a AIXI al permitir que los agentes bayesianos se modelen a sí mismos como parte de su entorno mediante la autopredicción, resolviendo así la no estacionariedad en entornos multiagente y logrando una teoría de la mente de orden infinito para facilitar nuevas formas de cooperación.
Artículo original bajo licencia CC BY 4.0 (http://creativecommons.org/licenses/by/4.0/). Esta es una explicación generada por IA del artículo a continuación. No ha sido escrita ni avalada por los autores. Para mayor precisión técnica, consulte el artículo original. Leer descargo de responsabilidad completo
Imagina que estás intentando enseñarle a un robot cómo jugar un juego. Durante décadas, la forma estándar de hacer esto ha sido dejar que el robot juegue, cometa errores, reciba una recompensa y luego intente hacer más de lo que funcionó y menos de lo que no. Esto se llama "aprendizaje por refuerzo", y es como entrenar a un perro con premios: esperas a que ocurra el comportamiento y luego das retroalimentación. Esto funciona de maravilla si el mundo es aburrido y no cambia. Pero, ¿qué pasa si el mundo está lleno de otros aprendices inteligentes, como otros robots o humanos, que también están cambiando sus estrategias basándose en lo que tú haces? De repente, los "premios" que recibiste ayer podrían no funcionar hoy porque tu oponente descubrió tu truco. Este es la realidad desordenada y caótica de la vida social, donde todos observan a todos y las reglas del juego cambian constantemente porque tú eres parte del juego.
Este artículo profundiza en esa realidad desordenada. Aborda un gran problema en la inteligencia artificial: ¿cómo construimos agentes (como la IA) que puedan aprender y cooperar en un mundo donde no son solo jugadores separados, sino que están realmente dentro del sistema que intentan comprender? Los autores se basan en una idea famosa llamada "AIXI", una superinteligencia teórica que predice el futuro adivinando qué reglas matemáticas describen el universo. Pero la versión clásica de esta idea trata a la IA como un observador que está fuera del universo, mirando hacia adentro. Los autores argumentan que esto es erróneo. En el mundo real, una IA es parte del universo, al igual que una persona es parte de una sociedad. Si quieres predecir lo que hará tu amigo, no puedes simplemente mirarlo; tienes que darte cuenta de que él también está pensando en ti. Este artículo propone un nuevo marco matemático donde la IA comprende que sus propias decisiones son parte de los datos que utiliza para predecir el futuro, permitiéndole razonar sobre otros que podrían estar pensando justo como ella.
El problema de "mirar hacia adentro"
Imagina que estás jugando una partida de ajedrez contra un amigo. En la vieja forma de pensar sobre la IA (llamada aprendizaje "desacoplado"), la IA miraría el tablero, pensaría: "Si muevo mi caballo aquí, mi amigo probablemente moverá su peón allá", y luego haría un movimiento. Trata a su propia mente como una máquina separada del tablero de ajedraz y de su amigo. Asume que su amigo es solo una parte estática del escenario que reacciona a los movimientos, no una entidad pensante que también está observando a la IA y tratando de adivinar qué hará la IA a continuación.
Los autores dicen que este enfoque está roto para las situaciones sociales. Si estás en una habitación con otra persona que intenta adivinar lo que harás, y tú estás intentando adivinar lo que ellos harán, te quedas atrapado en un bucle: "Yo pienso que ellos piensan que yo pienso..." Esto se llama una "recursión infinita" de la teoría de la mente. La vieja forma de hacer las cosas asume que el mundo es estático, como un nivel de un videojuego que no cambia. Pero en un mundo de múltiples agentes, el "nivel" cambia cada vez que alguien aprende algo nuevo. Si la IA no se da cuenta de que ella es la que está cambiando el nivel, seguirá haciendo malas suposiciones.
La nueva idea: Ser "embebido"
El artículo introduce el concepto de Agentes Bayesianos Embebidos. En lugar de estar fuera del universo mirando hacia adentro, estos agentes imaginan que están dentro de un "universo" que los incluye a ellos mismos, a sus amigos y al entorno, todo mezclado.
Piénsalo así: En el modelo antiguo, la IA es un director viendo una película e intentando predecir la trama. En el nuevo modelo, la IA es un actor en la película. Sabe que si decide llorar, los otros actores podrían reaccionar con consuelo, pero también sabe que los otros actores la están observando y podrían estar decidiendo llorar porque vieron a la IA luciendo triste.
Para lograr esto, la IA utiliza un tipo especial de predicción llamada autopredicción. No solo predice lo que el mundo le mostrará; predice lo que ella hará a continuación. Se pregunta: "Dado lo que sé sobre el mundo, ¿cuál es la acción más probable que tomaré?", y luego usa esa respuesta para adivinar lo que harán los otros agentes. Esto crea un bucle donde la creencia de la IA sobre sí misma le ayuda a entender a los demás, y su creencia sobre los demás le ayuda a entenderse a sí misma.
La magia de la "Similitud Estructural"
Aquí es donde se pone realmente interesante. El artículo sugiere que, debido a que todos estos agentes están ejecutando "software" similar (algoritmos), son estructuralmente similares. Imagina a dos gemelos que crecieron en la misma casa, fueron a la misma escuela y tienen el mismo cableado cerebral. Si le pides a uno de los gemelos que resuelva un acertijo, es probable que lo resuelva de la misma manera que lo haría el otro.
Los autores muestran que si una IA se da cuenta de: "Oye, ese otro agente probablemente está construido como yo", puede usar ese conocimiento para predecir el comportamiento del otro agente. Esto se llama similitud estructural. Si la IA sabe que "agentes similares se comportan de manera similar en situaciones similares", puede dejar de adivinar y empezar a saber.
Esto conduce a un resultado sorprendente en un juego clásico llamado el Dilema del Prisionero. En este juego, dos personas pueden o bien cooperar (ayudarse mutuamente) o desertar (traicionarse). La vieja forma de pensar dice que siempre deberías traicionar a la otra persona porque es el movimiento más seguro para ti individualmente. Pero los autores muestran que si dos agentes "embebidos" se dan cuenta de que son copias idénticas el uno del otro, ambos elegirán cooperar. ¿Por qué? Porque si yo elijo cooperar, sé que mi copia (el otro agente) también elegirá cooperar, porque estamos pensando exactamente lo mismo. La cooperación mutua les da a ambos una mejor recompensa que la traición mutua. El artículo demuestra que estos agentes pueden alcanzar matemáticamente este estado cooperativo, algo que los agentes "desacoplados" antiguos nunca podrían hacer.
La solución: MUPI y el "Oráculo Reflexivo"
El artículo no solo habla de esto; construye una máquina matemática para hacerlo realidad. Lo llaman MUPI (Inteligencia Predictiva Universal Embebida).
Para que esto funcione, tuvieron que resolver un rompecabezas complicado: ¿Cómo construir una IA que pueda predecirse a sí misma sin quedarse atrapada en un bucle infinito? Imagina intentar escribir un programa de computadora que imprima su propio código fuente. Si el programa intenta leer su propio código mientras lo está escribiendo, podría confundirse.
Los autores utilizan una herramienta matemática ingeniosa llamada Oráculo Reflexivo. Piensa en esto como un espejo mágico que puede mostrarte una imagen de ti mismo mirando un espejo, que a su vez mira un espejo, y así sucesivamente, sin que la imagen se vuelva borrosa o infinita. Esta herramienta permite que la IA razone sobre otros agentes que están utilizando las mismas herramientas de razonamiento, resolviendo efectivamente el problema de la "recursión infinita".
Demuestran que, si utilizas este marco, los agentes eventualmente aprenderán a predecirse perfectamente entre sí. A esto lo llaman alcanzar una teoría de la mente de orden infinito. Es como si los agentes finalmente pudieran detener el bucle de "Yo pienso que tú piensas que yo pienso..." y simplemente decir: "Ambos somos inteligentes, ambos somos similares, así que ambos elegiremos el mejor resultado para nosotros".
Qué significa esto
El artículo muestra que, al cambiar la forma en que pensamos sobre la IA —de un observador separado a un participante embebido— podemos desbloquear nuevas formas para que las máquinas cooperen. Demuestra que si los agentes pueden modelarse a sí mismos como parte del mundo, pueden descubrir naturalmente cómo trabajar juntos, incluso en situaciones complicadas donde podrían verse tentados a luchar.
Los autores son muy cuidadosos al decir que esto es un marco teórico. Han demostrado matemáticamente que estos agentes pueden existir y pueden converger hacia estas soluciones cooperativas. No han construido un robot que haga esto todavía en el mundo real, pero han mostrado el plano. Argumentan que esta es la forma correcta de pensar sobre el futuro de la IA, especialmente a medida que nos movemos hacia sistemas donde muchas IA tendrán que interactuar con humanos y entre sí. Sugiere que la clave de la inteligencia social no es solo darle a la IA más datos, sino enseñarle a darse cuenta de que es parte de la historia que está intentando predecir.
¿Ahogado en artículos de tu campo?
Recibe resúmenes diarios de los artículos más novedosos que coincidan con tus palabras clave de investigación — con resúmenes técnicos, en tu idioma.