Google ha actualizado su modelo de generación de vídeo con inteligencia artificial Gemini Omni Flash, y la nueva versión, bautizada como 1.1, llega con un puñado de mejoras que buscan hacer más accesible y controlable la producción audiovisual. La compañía ha puesto el foco en tres frentes: la continuidad de las escenas, el control creativo y el coste por segundo. El resultado es una herramienta que promete alargar los clips hasta 40 segundos sin perder la coherencia, y que además permite iterar sobre borradores baratos antes de gastar en resoluciones altas.
La actualización ya está disponible para desarrolladores a través de la API de Gemini y Google AI Studio, y también para los suscriptores de planes de Gemini y sus suscripciones en Flow y en la app de Gemini. Con esta versión, Google intenta responder a una de las quejas más habituales en el sector: la falta de memoria de los modelos para mantener la consistencia cuando se alarga una secuencia. Veamos qué trae exactamente.
Más contexto para escenas más largas
La función estrella de Gemini Omni 1.1 Flash es la extensión de escenas. A diferencia de la versión anterior, que solo analizaba el último segundo del vídeo original, ahora el modelo examina hasta 10 segundos de contexto previo. Eso le permite entender mejor la iluminación, el movimiento y la identidad de los personajes, y continuar la grabación con una coherencia mucho mayor. El sistema genera el metraje adicional en bloques de 10 segundos, y se pueden encadenar hasta un total de 40 segundos. Es decir, si tienes un clip de 10 segundos, puedes pedirle que lo alargue hasta 40, pero no de golpe: lo hará en tres pasos de 10 segundos cada uno, lo que da margen para revisar cada tramo antes de seguir.
Además, el modelo permite especificar un fotograma de inicio y otro de fin, y él se encarga de interpolar el movimiento entre ambos. Esto es útil para crear transiciones de cámara complejas, como órbitas, zooms o bucles, sin tener que describir cada paso. También se pueden cargar hasta tres segundos de vídeo como referencia visual, de modo que el modelo mantenga el estilo y los personajes de ese material en la nueva generación.
Control creativo y referencias visuales
Otra de las novedades es el modo de borrador a 360p. Esta resolución está pensada para hacer pruebas rápidas: funciona hasta un 60% más rápido y cuesta un tercio de lo que cuesta generar en 720p. Así, los creadores pueden iterar sobre una idea sin gastar demasiado, y cuando el resultado les convence, escalar el vídeo a 1080p o incluso a 4K. El escalado no es nativo, sino que se hace mediante upscaling, pero permite obtener una salida profesional sin necesidad de herramientas externas.
En cuanto a precios, Google ha fijado una tarifa por segundo de vídeo generado: 0,03 dólares en 360p, 0,10 en 720p, 0,15 en 1080p y 0,30 en 4K. Para hacerse una idea, un clip de 30 segundos en 1080p costaría unos 4,5 dólares, mientras que el mismo clip en 4K rondaría los 9 dólares. El modo borrador, en cambio, se quedaría en menos de un dólar. Esta estructura de precios busca que la fase de exploración sea barata y que el gasto se concentre en la versión final.
Precios, disponibilidad y comparativa
La disponibilidad de Gemini Omni 1.1 Flash es amplia: está en Google AI Studio, en la API de Gemini, en la plataforma Gemini Enterprise Agent y en Google Flow para los suscriptores de pago. La función de extensión de escenas también ha llegado a la app de Gemini para esos mismos usuarios. Además, Google ha integrado el modelo en Adobe Firefly y en su herramienta Vids, lo que amplía el abanico de usos.
En el contexto competitivo, la salida de Sora de OpenAI ha dejado un hueco que Google quiere aprovechar. Frente a Veo 3.1, que se centra en generación one-shot de alta calidad, Omni Flash está pensado para edición conversacional e iterativa. Y en comparación con otros modelos como Runway Gen-4.5 o Grok Imagine Video, el precio de Omni 1.1 Flash resulta competitivo, sobre todo en el modo borrador. Para los equipos que trabajan con vídeo generativo, la posibilidad de prototipar a 360p y luego escalar a 4K cambia el cálculo de costes por pieza.
En definitiva, Gemini Omni 1.1 Flash no es una revolución, pero sí un paso importante para que la generación de vídeo con IA sea más práctica y asequible. La combinación de extensión de escenas con contexto amplio, control por fotogramas clave y un modo borrador económico la convierten en una opción a tener en cuenta para productores, agencias y desarrolladores. Habrá que ver cómo responde en la práctica, pero la propuesta de Google apunta a resolver los dos grandes escollos del sector: la coherencia narrativa y el coste de iteración.
Continúar leyendo...