Google actualiza Gemini Omni Flash: escenas de hasta 40 segundos

Google ha puesto a disposición del público la versión 1.1 de su modelo de inteligencia artificial generativa Gemini Omni Flash, una actualización que potencia la producción de vídeo profesional. Entre las principales novedades se encuentra la posibilidad de extender una escena hasta 40 segundos, así como la interpolación entre el primer y el último fotograma, el escalado nítido a resolución 4K y una creación de prototipos más ágil.

La compañía ya había presentado el modelo original Gemini Omni durante su evento anual para desarrolladores Google I/O 2026. Posteriormente, lanzó la versión Gemini Omni Flash junto con Nano Banana 2 Lite, posicionándola como una herramienta multimodal capaz de generar vídeos de 10 segundos con un enfoque empresarial y alta velocidad de procesamiento.

Escenas más largas con coherencia narrativa

Ahora, con la llegada de Gemini Omni 1.1 Flash, Google busca ofrecer un mayor control sobre la producción de vídeo y una iteración más rápida. La función estrella permite tomar un vídeo existente y continuar generando metraje “sin interrupciones” desde el punto donde se detuvo, según explicó la empresa en un comunicado oficial.

Para lograrlo, el modelo analiza hasta 10 segundos del contexto previo —en lugar de solo el último segundo como en la versión anterior— y, a partir de ahí, genera más tiempo de escena con una “mejor adherencia narrativa”. Esto posibilita que los usuarios creen historias de hasta 40 segundos, ampliando las escenas de 10 segundos en bloques de 10 segundos.

Transiciones fluidas y escalado profesional

Otra mejora relevante es la capacidad de generar transiciones y movimientos de cámara suaves mediante la interpolación del primer y el último fotograma de cada toma. Google detalla que esto resulta útil para crear “órbitas de cámara complejas, transiciones de zoom o bucles sin interrupciones”.

Además, Omni 1.1 produce previsualizaciones ligeras en resolución 360p hasta un 60% más rápido y “a un tercio del coste” en comparación con la resolución estándar de 720p. También permite el escalado de vídeo a 4K, generando imágenes de alta resolución a 1080p o 4K para uso profesional.

Referencias de vídeo y disponibilidad

El modelo incorpora la posibilidad de agregar referencias de vídeo en la entrada multimodal. En concreto, los usuarios pueden utilizar hasta 3 segundos de vídeo como referencia para crear una escena, y el sistema mantendrá el contexto visual y la coherencia de los personajes basándose en dichas referencias.

La implementación de Omni 1.1 está en marcha en Google AI Studio, en la API de la plataforma Gemini Enterprise Agent y para todos los suscriptores de Google AI Plus, Pro y Ultra a nivel global en Google Flow. Asimismo, la función de extender escenas ya está disponible para los suscriptores en todo el mundo a través de la aplicación Gemini.

Fuente: Infobae

COMPARTIR ESTA NOTICIA

Facebook
Twitter

FACEBOOK