Google ha presentado este lunes Gemini Omni 1.1 Flash, una actualización de su modelo de inteligencia artificial para generación de vídeo que incorpora nuevos controles creativos orientados a desarrolladores y profesionales del sector audiovisual. El lanzamiento, anunciado en el blog oficial de la compañía, marca el paso de Omni a una versión lista para producción dentro de la API de Gemini en Google AI Studio.
La principal novedad es la ampliación de la duración de las escenas generadas. Según Google, el modelo puede analizar ahora hasta diez segundos de contexto previo —frente al único segundo de las versiones anteriores— para mantener la coherencia visual y narrativa. Los usuarios pueden extender vídeos en tramos de diez segundos hasta alcanzar una duración acumulada de 40 segundos, lo que permite construir historias más largas o explorar bifurcaciones creativas sin perder consistencia entre planos.
Otra de las herramientas destacadas es la posibilidad de especificar fotogramas inicial y final de una toma. Omni 1.1 genera vídeo continuo entre dos keyframes, una función pensada para transiciones suaves, movimientos de cámara complejos como órbitas o zooms, y clips en bucle. Google ofrece ejemplos de prompts que van desde un plano de un batería en un gran salón que termina mostrando a un saxofonista junto a una bailarina, hasta una transición hacia el interior de una pantalla de televisión.
En materia de eficiencia, la versión 1.1 permite generar previsualizaciones en 360p hasta un 60% más rápido y a un tercio del coste respecto a la resolución estándar de 720p, según datos de rendimiento proporcionados por la propia compañía. Esta modalidad está pensada para prototipado rápido, iteración de storyboards y renderizado ágil en plataformas de desarrollo. Para producción final, el modelo ofrece escalado (upscaling) hasta resoluciones de 1080p y 4K, listas para uso profesional.
El sistema también admite ahora referencias de vídeo de hasta tres segundos como parte de la entrada multimodal, lo que facilita mantener la coherencia visual y de personajes basándose en material previo. Google ilustra esta capacidad con un ejemplo en el que personajes como un perro, un oso y un pulpo deben replicar distintos estilos de danza extraídos de vídeos de referencia.
Google ha confirmado que Omni 1.1 ya está disponible en su ecosistema de desarrolladores: en Google AI Studio para experimentación, a través de la Agent Platform API para empresas, y mediante documentación oficial, cookbooks y guías de prompt. Además, los suscriptores de Google AI Plus, Pro y Ultra pueden acceder al modelo en Google Flow a nivel global, y la función de extensión de escenas llega también a la aplicación Gemini.
Sobre la naturaleza del producto, la publicación tecnológica alemana Heise aporta una perspectiva complementaria. El medio recuerda que Gemini Omni Flash fue presentado en mayo durante la conferencia Google I/O y que, a diferencia del modelo de vídeo Veo —también de Google—, Omni no funciona como un modelo generativo de vídeo al uso, sino como una "capa de orquestación" descrita por la propia compañía como "una conversación continua con un director". En lugar de generar vídeo únicamente a partir de un prompt aislado, Omni coordina y refina la creación de forma iterativa.
En el plano competitivo, Heise sitúa a Omni Flash frente a modelos como Seedance 2.0 de ByteDance —cuyo lanzamiento estuvo rodeado de controversias por derechos de autor y de momento solo opera en China— y Kling 3.0, lo que refleja la creciente presión en el segmento de generación de vídeo por IA, donde cada pocos meses aparecen actualizaciones que prometen mayor control, mayor duración y mayor resolución.
El movimiento de Google llega en un momento de intensa competencia en el terreno de la generación de vídeo mediante inteligencia artificial. Modelos como Sora de OpenAI, Veo de Google, Kling de Kuaishou y los citados Seedance y Runway compiten por atraer a desarrolladores, estudios y creadores de contenido. La apuesta de Omni por el control creativo fino —keyframes, extensiones de escena, referencias multimodales— sugiere una estrategia diferenciadora: en lugar de competir solo en calidad de imagen, Google busca posicionarse como una herramienta de producción integrada en flujos de trabajo profesionales.
Por ahora, los desarrolladores ya pueden probar Omni 1.1 Flash en Google AI Studio y consultar la documentación oficial. Queda por ver cómo responde la comunidad creativa y si los nuevos controles cumplen las expectativas de coherencia narrativa y calidad visual que Google promete para entornos de producción reales.
