# google-deepmind-project-genie-3-world-models-2026-02

## Veille

Project Genie - Modelos de mundo interactivos en tiempo real de Google DeepMind

## Titre Article

Project Genie: Interactive World Models with Genie 3

## Date

2026-02

## URL

https://www.youtube.com/watch?v=Ow0W3WlJxRY

## Keywords

World models, Project Genie, Genie 3, Google DeepMind, Google Labs, generación de mundos interactivos, tiempo real, Nano Banana Pro, simulación, robótica, inteligencia encarnada, Simmer, agentes de IA, medios interactivos, realidad virtual

## Authors

Logan Kilpatrick (Google DeepMind), Diego Schlomi (Google DeepMind), Jack (Google DeepMind)

## Ton

**Perfil**: Conversación técnica entre miembros del equipo de producto/investigación, registro accesible y entusiasta, nivel técnico moderado con divulgación

**Descripción**: Formato podcast "Release Notes" con tres presentadores de Google DeepMind que presentan Project Genie de forma conversacional. El tono es el de una demostración de producto distendida, alternando entre explicaciones técnicas accesibles y momentos de descubrimiento espontáneo durante demos en directo. El entusiasmo es palpable pero mesurado, con honestidad sobre las limitaciones actuales del modelo. Los presentadores adoptan la postura de exploradores que comparten una tecnología de frontera, invitando a la audiencia a experimentar en lugar de consumir un producto acabado. El público objetivo es amplio: desarrolladores, creativos, early adopters tecnológicos.

## Pense-betes

- **World model vs modelo de vídeo**: Un modelo de vídeo genera una secuencia fija; un world model genera fotograma a fotograma con control del usuario en tiempo real (izquierda/derecha/acciones)
- **Project Genie = aplicación de consumo**: El equivalente a lo que Flow/ISK son para VO, lanzado para los suscriptores de Google US Ultra
- **Pipeline creativo**: Nano Banana Pro genera primero una imagen "canvas", luego Genie 3 transforma esta imagen en un mundo explorable
- **Personalización clave**: Subir fotos personales (juguetes, objetos, espacios) para animarlos, un diferenciador frente a otros sistemas
- **Límite de 60 segundos**: Compromiso coste/servicio, el dinamismo disminuye progresivamente, "dos mundos de un minuto > un mundo de dos minutos"
- **Física implícita**: El modelo aprende implícitamente cómo evoluciona el mundo (bolas que ruedan, agua que salpica)
- **Un problema más difícil que el vídeo**: Sin libertad para modificar fotogramas pasados/futuros, debe ser coherente tanto con el pasado COMO con la acción inmediata
- **Trayectoria de Genie**: Genie 1 (artículo de investigación) → Genie 2 (dic. 2024, 10s, baja resolución) → Genie 3 (anuncio ago. 2025, 1 min en tiempo real fotorrealista)
- **Caso de uso Simmer**: Agente Gemini capaz de interactuar en mundos 3D, entrenado en mundos Genie 3 para probar la generalización
- **Hoja de ruta mencionada**: Multijugador (latencia compleja), más controles/interacciones, API para desarrolladores, superficies más allá de la aplicación
- **"El prompting vuelve"**: El modelo aún no es robusto frente al prompting, se requiere experimentación, una oportunidad para los early adopters
- **Visión a largo plazo**: "Una copia del universo donde se puede hacer lo que se quiera", una simulación indistinguible de la realidad como estrella polar

## RésuméDe400mots

Google DeepMind lanza Project Genie, una aplicación web que permite a los suscriptores de Google US Ultra crear y explorar mundos interactivos generados por el modelo Genie 3. A diferencia de los modelos de vídeo convencionales que producen secuencias fijas, un "world model" genera el entorno fotograma a fotograma en tiempo real, permitiendo al usuario navegar e interactuar.

**Flujo de trabajo y pipeline creativo**: El usuario comienza describiendo su mundo y su personaje. Nano Banana Pro genera primero una imagen "canvas" que sirve como punto de partida visual. Al hacer clic en "Generate World", Genie 3 transforma esta imagen 2D en un entorno 3D explorable. La transición de 2D a un 3D inmersivo es el "wow moment" identificado por los evaluadores. La aplicación también permite subir fotos personales: un dinosaurio de juguete fotografiado puede convertirse en un personaje controlable dentro de una reconstrucción de la habitación.

**Desafíos técnicos**: Genie 3 aborda un problema más complejo que la generación de vídeo estándar. Un modelo de vídeo puede ajustar retroactivamente los fotogramas para garantizar la coherencia; Genie 3 debe generar en tiempo real, coherente tanto con el pasado COMO con la acción inmediata del usuario, sin conocer las entradas futuras. El límite actual de 60 segundos resulta de un compromiso: el dinamismo del mundo tiende a disminuir progresivamente, y los costes de servicio siguen siendo elevados.

**Evolución desde Genie 1**: Genie 1 fue un artículo de investigación. Genie 2 (diciembre de 2024) ofrecía 10 segundos en baja resolución, sin tiempo real. Genie 3 (anunciado en agosto de 2025, ahora lanzado) alcanza un minuto en tiempo real con calidad fotorrealista. El equipo señala que hace un año, un minuto de coherencia en tiempo real parecía un objetivo ambicioso; hoy, los usuarios piden más.

**Aplicaciones previstas**: Más allá del entretenimiento, el equipo explora la educación (exposiciones terapéuticas personalizadas, como un niño explorando una habitación llena de arañas virtuales) y la inteligencia encarnada. El proyecto Simmer ya utiliza Genie 3 para entrenar agentes de IA capaces de lograr objetivos en mundos 3D arbitrarios, un paso hacia una AGI encarnada.

**Perspectivas**: La hoja de ruta incluye multijugador (complejo debido a la latencia), más controles de interacción, una API para desarrolladores y la expansión a otras superficies. El equipo estima haber alcanzado el 50% de su visión, con un "margen de mejora enorme" para seguir avanzando. La visión última: una simulación indistinguible de la realidad, "una copia del universo donde se puede hacer lo que se quiera".

## GrapheDeConnaissance

- Google DeepMind —a_créé→ Genie 3 (TECHNOLOGIE, 0.99)
- Google DeepMind —publie→ Project Genie (TECHNOLOGIE, 0.99)
- Project Genie —est_basé_sur→ Genie 3 (TECHNOLOGIE, 0.98)
- Project Genie —utilise→ Nano Banana Pro (TECHNOLOGIE, 0.97)
- Genie 3 —remplace→ Genie 2 (TECHNOLOGIE, 0.98)
- Google DeepMind —publie→ Genie 2 (TECHNOLOGIE, 0.95)
- Genie 3 —est_instance_de→ modèles de monde interactifs (CONCEPT, 0.95)
- Google DeepMind —affirme_que→ les world models résolvent un problème plus difficile que les modèles vidéo (AFFIRMATION, 0.97)
- Simmer —utilise→ Genie 3 (TECHNOLOGIE, 0.96)
- Simmer —fait_partie_de→ Google DeepMind (ORGANISATION, 0.9)
- Google Labs —collabore_avec→ Google DeepMind (ORGANISATION, 0.97)
- Genie 3 —s_applique_à→ intelligence incarnée (CONCEPT, 0.88)
- Logan Kilpatrick —dirige→ Release Notes (EVENEMENT, 0.99)
- modèles de monde interactifs —permet→ génération temps réel (CONCEPT, 0.96)
- Google DeepMind —prédit→ simulation indistinguable de la réalité (AFFIRMATION, 0.82)

---
Canonical: https://www.thekb.eu/es/fiches/google-deepmind-project-genie-3-world-models-2026-02/
