Google presentó Gemini Omni 1.1 Flash, una versión renovada de su modelo de inteligencia artificial orientado a la generación de video. La actualización introduce la capacidad de procesar contenidos en resolución 4K y extiende la duración de las escenas que los usuarios pueden crear en la plataforma. La extensión de escena está disponible para todos los suscriptores de Google AI Plus, Pro y Ultra a nivel global en Gemini.
A partir de esta entrega, el sistema permite elaborar secuencias de hasta 40 segundos mediante la extensión progresiva de fragmentos. Asimismo, la herramienta habilita la incorporación de fotogramas clave para determinar con precisión el inicio y el cierre de cada toma, una función pensada para afinar el control creativo en la producción audiovisual.
El desarrollo aborda uno de los desafíos más complejos que enfrentan las herramientas de video generativo: la pérdida de coherencia visual a medida que la escena se prolonga. Para evitar inconsistencias, el modelo incrementa el volumen de datos que analiza del tramo previo, lo que preserva con mayor exactitud la física del entorno, los patrones de movimiento, las condiciones de iluminación y los rasgos faciales de las personas en pantalla.
La modificación central radica en la expansión de la memoria visual de la plataforma. Tras la actualización, el sistema toma como referencia hasta diez segundos del video original para dar continuidad a la toma, una cifra superior frente al segundo de contexto que procesaba la versión precedente. Este salto técnico reduce los cambios repentinos en la posición de objetos o en la dirección de la luz al momento de extender una animación.