La demostración comenzó de forma bastante inocente: un pincel digital dibujando un bosque en la pantalla. Segundos después, los árboles se balanceaban con una brisa inexistente, y un avatar tosco comenzó a explorar. Pero cuando el presentador hizo zoom hacia atrás, revelando que el «mundo» entero cabía perfectamente dentro de la pantalla de un teléfono inteligente, un escalofrío me recorrió la columna vertebral: ¿era esto una vislumbre del futuro o solo una ilusión sofisticada?
Google está incursionando en algo nuevo, pero la cuerda de terciopelo está puesta. Esta semana, lanzaron el Proyecto Genie, llamándolo un «modelo mundial de propósito general» capaz de generar entornos interactivos. Después de que un pequeño grupo de prueba solo por invitación jugó con él el pasado agosto, Genie 3 ahora está disponible para los suscriptores de Google AI Ultra en los EE. UU… por solo $250 (€230) al mes.
El atractivo de los «modelos mundiales»
Considera la diferencia entre memorizar un mapa y realmente conducir la ruta. Los modelos de lenguaje grandes (LLM) como el propio Gemini de Google reconocen patrones, pero los modelos mundiales simulan entornos, aprendiendo física y relaciones espaciales. Es un enfoque diferente a la IA.
Yann LeCun, anteriormente el científico jefe de Meta AI, defiende los modelos mundiales. LeCun cree que los LLM no lograrán una verdadera inteligencia general artificial. Él recientemente se unió a una startup apostando fuerte por los modelos mundiales. Piénsalo de esta manera: los LLM detectan tendencias, mientras que los modelos mundiales ejecutan simulaciones para deducir cómo funciona el mundo y predecir resultados.
La entrada de Google valida el potencial de los modelos mundiales. Los videos de vista previa de las primeras etapas del Proyecto Genie muestran una promesa visual, a pesar de ser breves. Google limita a los usuarios a generaciones mundiales de 60 segundos que «podrían no verse completamente realistas o siempre adherirse estrictamente a las indicaciones o imágenes, o la física del mundo real»; en otras palabras, los resultados varían. Las salidas son videos de 720p a 24 fotogramas por segundo, según Ars Technica, y algunos usuarios informan problemas de retraso.
I got early access to Project Genie from @GoogleDeepMind
It’s unlike any realtime world model I’ve tried – you generate a scene from text or a photo, and then design the character who gets to explore it.
I tested dozens of prompts. Here are the standout features pic.twitter.com/I6CPJzPzIG
— Justine Moore (@venturetwins) January 29, 2026
Eso es de esperar en la versión beta. Sin embargo, insinúa limitaciones: el mundo podría ser más pequeño de lo esperado. Las afirmaciones de que esto eliminará a los desarrolladores de videojuegos pueden ser prematuras. Por ahora, trata el Proyecto Genie como un prototipo, no como un producto.
Project Genie is rolling out for AI Ultra members in the USA. It’s an experimental tool that allows you to create and explore infinite virtual worlds, and I’ve never seen anything like this. It’s still early, but it’s already unreal.
Nano Banana Pro + Project Genie = My low-poly… pic.twitter.com/mkMEw2GxxU
— Josh Woodward (@joshwoodward) January 29, 2026
¿Cómo se relaciona el Proyecto Genie con la visión del modelo mundial de Yann LeCun?
El Genie 3 de Google difiere de la visión de LeCun. El Proyecto Genie crea mundos continuos basados en video que se pueden navegar como videojuegos, lo que permite a los agentes de IA aprender explorando. El concepto de Meta de LeCun, Joint Embedding Predictive Architecture (JEPA), incrusta un modelo mundial dentro del propio agente de IA.
Preocupaciones sobre los derechos de autor y los límites de la escala
El camino no está exento de espinas. Google enfrentará los mismos problemas de derechos de autor que afectan a otros modelos de generación de imágenes y videos como Sora 2 de OpenAI. Las primeras salidas del Proyecto Genie frecuentemente replican los mundos de Nintendo, lo que levantará banderas rojas rápidamente. Aún así, la inversión de Google sugiere que incluso los líderes de la IA ven límites potenciales para los LLM. La compañía está sembrando semillas para un futuro más allá del reconocimiento de patrones.
Holy moly… Genie 3 just created this mock 3D game world from Breath of the Wild.
How I did it + prompts in comment. https://t.co/IrwlZ1pTMs pic.twitter.com/H33an42YNd
— Min Choi (@minchoi) January 29, 2026
¿Cuáles son las limitaciones del Proyecto Genie de Google?
El proyecto tiene un límite por una razón. Si entrenar un modelo basado en texto es costoso, imagina simular un mundo entero. Requiere datos masivos para comprender las imágenes y la física, además de una enorme potencia de procesamiento. Escalarlo presenta obstáculos importantes. Entonces, por ahora, los mundos pueden parecer expansivos, pero son prácticamente diminutos. El Proyecto Genie es como un pez dorado en una pecera: parece más grande de lo que es.
¿Cuál es la diferencia entre los LLM y los modelos mundiales?
Los LLM son como enciclopedias; contienen vastas cantidades de información. Los modelos mundiales son más como motores de física. Los primeros pueden repetir y reensamblar información; los últimos entienden cómo interactúa realmente esa información. Este enfoque puede ser lo que se necesita para imitar verdaderamente la inteligencia humana.
¿Escaparán los modelos mundiales como el Proyecto Genie de sus limitaciones, o seguirán siendo una costosa curiosidad?
Apoya nuestro trabajo ❤️
Si te ha gustado este artículo, considera dejar una propina para ayudarnos a seguir publicando contenido de calidad.




















