
Google ha presentado Gemini Omni 1.1 Flash, una nueva versión de su tecnología de inteligencia artificial orientada a la generación y edición de vídeo. Según la información publicada por Hipertextual, el modelo incorpora funciones para ampliar escenas, crear clips a partir de imágenes de referencia y trabajar con diferentes resoluciones, además de una modalidad de prototipado pensada para probar ideas de forma más rápida y económica.
Gemini Omni 1.1 Flash puede ampliar vídeos existentes
Una de las principales novedades de Gemini Omni 1.1 Flash es la posibilidad de extender un vídeo que ya ha sido creado. De acuerdo con la fuente, la herramienta puede añadir hasta 40 segundos de contenido manteniendo una continuidad coherente con el material original y procurando conservar tanto la narración como la consistencia visual.
La tecnología introduce además un cambio respecto a la primera versión de Omni. Según los datos facilitados, Gemini Omni 1.1 Flash analiza los últimos 10 segundos del vídeo que se quiere prolongar, en lugar de fijarse únicamente en el último segundo. La compañía considera que disponer de este contexto adicional permite conseguir una transición más fiel respecto al contenido original.
Eso sí, esos 40 segundos no se generan de una sola vez. El modelo permite realizar ampliaciones de hasta 10 segundos por cada generación, según explica la información publicada. De esta manera, el usuario puede ir construyendo una escena más larga a partir del vídeo inicial y de las extensiones generadas posteriormente.
También permite controlar cómo empieza y termina el vídeo
Otra de las funciones destacadas permite generar un vídeo utilizando el primer y el último fotograma como referencias. El usuario puede proporcionar ambas imágenes y dejar que la inteligencia artificial genere el contenido intermedio necesario para conectar esos dos puntos.
Esta posibilidad puede resultar especialmente útil cuando se necesita controlar el principio y el final de un clip, ya que permite establecer dos referencias visuales concretas antes de generar la secuencia. Según la información disponible, el modelo se encarga posteriormente de crear el desarrollo que conecta ambos fotogramas.
La propuesta de Google combina generación y edición de vídeo, con herramientas pensadas tanto para crear contenido desde referencias visuales como para modificar y ampliar material que ya existe.
El enfoque supone que Gemini Omni 1.1 Flash no se limita a generar vídeos desde cero. Según la fuente, también está diseñado para trabajar sobre contenido existente, algo que puede facilitar determinados procesos de edición y creación audiovisual en los que ya existe una base sobre la que continuar.
Un modo de 360p para probar ideas antes de generar el vídeo final
Google también ha incorporado una función pensada para quienes necesitan experimentar antes de producir una versión definitiva. Gemini Omni 1.1 Flash permite crear prototipos de vídeo en resolución 360p, una alternativa que, según la información publicada, busca reducir tanto los tiempos de generación como el coste.
La idea es utilizar esta calidad inferior como una especie de borrador. De acuerdo con la fuente, el usuario puede desarrollar una idea, introducir cambios y comprobar diferentes resultados antes de pasar a una generación con mayor calidad. Esto puede ser útil cuando todavía se está definiendo el contenido de una escena.
El sistema está pensado para evitar que cada prueba tenga que realizarse directamente en una resolución elevada. Según los datos facilitados, el prototipo en 360p es más rápido y económico, por lo que permite hacer modificaciones antes de invertir recursos en la versión final.
Este planteamiento también encaja con una dinámica habitual en la creación audiovisual: primero se comprueba si una idea funciona y después se prepara el resultado definitivo. En este caso, según la información publicada, la inteligencia artificial permite realizar esa fase de prueba directamente dentro del proceso de generación.
La herramienta también puede escalar vídeos hasta 4K
Gemini Omni 1.1 Flash incorpora además funciones para aumentar la resolución de vídeos. Según la fuente, el sistema puede utilizarse para escalar clips a resoluciones superiores a la original, incluyendo contenidos que originalmente tengan una calidad inferior.
Entre las resoluciones mencionadas se encuentran 1080p y 4K. Esto abre otra posibilidad de uso para la herramienta, ya que no estaría limitada a la creación de nuevas secuencias, sino que también podría utilizarse en determinados flujos de trabajo en los que se necesita trabajar con material de mayor resolución.
El coste de esta función depende de diferentes factores. De acuerdo con los datos publicados, el precio varía según la resolución y la duración del vídeo generado. Por tanto, producir un clip de mayor calidad durante más tiempo supone un coste superior que utilizar una resolución más baja y una duración menor.
- 360p: 0,03 dólares por segundo.
- 720p: 0,10 dólares por segundo.
- 1080p: 0,15 dólares por segundo.
- 4K: 0,30 dólares por segundo.
Estas cifras corresponden a los precios indicados en la información publicada sobre el lanzamiento. Así, la generación en 4K tiene un coste diez veces superior a la generación en 360p, mientras que las resoluciones intermedias quedan situadas entre ambos extremos.
Gemini Omni 1.1 Flash ya está disponible en varios servicios de Google
La nueva tecnología ya se encuentra disponible para determinados usuarios de los servicios de Google. Según la información publicada, Gemini Omni 1.1 Flash está incluido para los suscriptores de Google AI Plus, Pro y Ultra a través de Google Flow.
La función para ampliar escenas también llega a la aplicación de Gemini para los usuarios que dispongan de alguno de estos planes de pago. De esta forma, las capacidades de generación y extensión de vídeo no quedan limitadas exclusivamente a una herramienta destinada a profesionales o desarrolladores.
Google también ofrece acceso a Gemini Omni 1.1 Flash mediante su API y Google AI Studio, de acuerdo con los datos facilitados. Esto permite que desarrolladores y otros usuarios puedan integrar o experimentar con la tecnología desde herramientas orientadas al desarrollo de aplicaciones basadas en inteligencia artificial.
En conjunto, la llegada de Gemini Omni 1.1 Flash amplía las posibilidades de la plataforma de Google en el terreno del vídeo generado mediante IA. Según la fuente, la combinación de extensión de escenas, referencias de inicio y final, prototipos económicos y escalado de resolución busca cubrir distintas fases del proceso de creación audiovisual.
Por ahora, las características y precios mencionados corresponden a la información disponible sobre este lanzamiento. La propuesta de Google sitúa a Gemini Omni 1.1 Flash como una herramienta centrada no solo en generar vídeo, sino también en experimentar, editar y continuar contenidos existentes, con diferentes opciones de calidad y coste en función de las necesidades de cada proyecto.
Fuente: https://gemini.google/es/overview/video-generation/?hl=es