IA
Google lanzó Gemini Omni 1.1 Flash, un modelo de IA generativa que extiende vídeos existentes hasta 40 segundos, genera escenas intermedias entre dos fotogramas, usa clips de referencia de hasta 3 segundos y produce contenido en resoluciones de hasta 4K.

Google ha presentado Gemini Omni 1.1 Flash, una nueva versión de su modelo de inteligencia artificial generativa diseñada para la creación y edición avanzada de vídeo. Entre sus capacidades figuran la extensión de secuencias ya grabadas, la generación automática de imágenes intermedias entre un fotograma inicial y otro final, el uso de vídeos cortos como referencias visuales y la producción de contenidos en resolución hasta 4K.
El modelo puede analizar hasta 10 segundos de la secuencia previa al punto de extensión, una mejora respecto a versiones anteriores que solo procesaban el último segundo del clip original. Los desarrolladores pueden añadir extensiones progresivas de 10 segundos cada una, con un límite acumulado de 40 segundos por secuencia. Esta funcionalidad otorga a los creadores de contenido mayor flexibilidad para completar escenas sin alterar sus elementos visuales ni su coherencia narrativa.
Otra novedad es la posibilidad de definir explícitamente el primer y el último fotograma de una escena y dejar que el modelo genere las imágenes necesarias para conectarlos fluidamente. La herramienta maneja movimientos complejos de cámara —como giros alrededor de objetos o acercamientos— y transiciones que favorecen la continuidad visual o la repetibilidad del fragmento. Así, los usuarios especifican el resultado deseado en lugar de depender únicamente de descripciones textuales para construir el vídeo desde cero.
Gemini Omni 1.1 Flash admite la utilización de clips de hasta 3 segundos como referencias durante la generación de nuevos vídeos. Esta característica permite preservar detalles específicos del material de origen, como la apariencia de los personajes o las características del entorno visual. Google también mostró casos en los que se emplean múltiples clips de referencia dentro de un único vídeo continuo para reproducir distintos tipos de movimiento.
La plataforma incorpora ahora la opción de generar vídeos en resolución 360p, orientada a pruebas rápidas de ideas creativas antes de pasar a formatos de mayor calidad. Según Google, la producción de borradores en 360p es hasta un 60 % más veloz que en 720p y cuesta aproximadamente un tercio del precio de un vídeo en esa resolución. Este modo está dirigido especialmente al desarrollo ágil de storyboards y prototipos iniciales, tras los cuales los desarrolladores pueden exportar la versión final en 1080p o 4K.
Los desarrolladores pueden integrar el modelo mediante la API de Gemini dentro de Google AI Studio, mientras que los clientes empresariales lo acceden a través de la Agent Platform API. Google ha publicado documentación técnica, guías prácticas, ejemplos funcionales y recomendaciones para redactar instrucciones efectivas de generación de vídeo. El modelo está disponible globalmente para usuarios suscritos a los planes AI Plus, AI Pro y AI Ultra, tanto en la plataforma Google Flow como en la aplicación Gemini, donde también se ofrece la función de extensión de escenas.
Google confirmó que Gemini Omni 1.1 Flash ya se integra en los flujos de producción de varias empresas y plataformas, entre ellas Adobe, Figma Weave, GMI Cloud y Runway. El lanzamiento refleja la estrategia de la compañía de evolucionar sus herramientas de IA más allá de la generación desde cero, hacia capacidades que comprenden, completan y manipulan secuencias preexistentes manteniendo coherencia visual, control preciso sobre movimientos y transiciones, y consistencia narrativa.



