Google avanza hacia la inteligencia artificial general con su nuevo modelo del mundo Genie 3
Presentación de Genie 3
Google DeepMind ha lanzado Genie 3, un innovador modelo del mundo (world model) que permite la generación de entornos 3D en tiempo real a partir de una imagen o una indicación textual. La empresa afirma que este nuevo algoritmo no solo amplía las oportunidades para crear experiencias educativas, creativas y orientadas a videojuegos, sino que también representa un avance significativo hacia la inteligencia artificial general, que busca igualar o incluso superar las capacidades cognitivas humanas.
La agencia de desarrollo de negocios The Black Box Lab explica que los modelos mundiales son algoritmos que crean representaciones internas de un entorno, permitiendo que las soluciones de IA simulen eventos y predigan resultados futuros basados en estas emulaciones. Este enfoque tiene como objetivo replicar los procesos de razonamiento humano, dotando a las máquinas de una comprensión más profunda del contexto físico.
Capacidades del Modelo del Mundo
De acuerdo con un artículo de TechCrunch, un modelo generativo entrenado con años de video puede identificar con precisión que una pelota de baloncesto rebota, pero carece de la capacidad para entender por qué sucede. En contraste, un modelo del mundo tiene “una comprensión básica” de las causas del rebote, lo que le permite representar el fenómeno y anticipar movimientos futuros con mayor precisión.
Google ha estado invirtiendo recursos significativos en la investigación de esta tecnología. A finales del año pasado, la compañía presentó Genie 2, un modelo que podía crear mundos interactivos a partir de imágenes. En enero, Google formó un equipo especializado en el desarrollo de modelos del mundo, liderado por Tim Brooks, excodirector del proyecto Sora de OpenAI.
Avances y Funcionalidades de Genie 3
Con Genie 3, la compañía ha logrado un avance significativo en este ámbito: es el primer modelo del mundo de Google que permite la interacción en tiempo real y mejora notablemente la consistencia y el realismo en comparación con su predecesor. El nuevo algoritmo genera automáticamente entornos virtuales en 3D que los usuarios o agentes de IA pueden explorar “durante varios minutos”. Aunque los desarrolladores no especifican una duración exacta, esta mejora representa un gran salto respecto a los 10 a 20 segundos que ofrecía Genie 2.
Las simulaciones se realizan a una resolución de 720 píxeles y 24 fotogramas por segundo. Además, son compatibles con “eventos mundiales con indicaciones”, lo que significa que pueden ser modificadas mediante comandos que alteren aspectos como el clima o la inclusión de nuevos personajes en la escena.



