Google abre Gemini Omni 1.1 Flash a desarrolladores con extensión de escenas, interpolación entre fotogramas, borradores económicos y salida en 4K.
Google ha puesto Gemini Omni 1.1 Flash a disposición de los desarrolladores como una actualización preparada para producción de su modelo de vídeo. Se puede utilizar mediante la API de Gemini en Google AI Studio para construir herramientas creativas y flujos de edición propios.
Una de sus funciones principales es la extensión de escenas. El modelo analiza hasta diez segundos de contexto anterior y continúa el vídeo en bloques de diez segundos, con una duración acumulada máxima de cuarenta segundos.
El contexto ampliado busca mantener con mayor precisión los personajes, el entorno, el movimiento y la dirección narrativa. También permite crear ramificaciones de una misma escena a partir de indicaciones diferentes.
La API admite un fotograma inicial y otro final para generar la transición intermedia. Esta función permite planificar desplazamientos de cámara o cambios de composición con dos puntos visuales claramente definidos.
Para acelerar las pruebas, Gemini Omni 1.1 Flash puede producir previsualizaciones a 360p. Google plantea esta resolución como una forma de iterar sobre prompts y composiciones antes de pagar el coste de un resultado más pesado.
Los proyectos terminados pueden ampliarse a resolución 4K. El mismo conjunto de funciones sirve así para pasar de un prototipo rápido a una salida que pueda incorporarse a un flujo de producción de vídeo.
La disponibilidad mediante API diferencia este anuncio de su integración en Flow: los equipos pueden incorporar el modelo en aplicaciones, editores y automatizaciones propios en lugar de limitarse a utilizar la interfaz de Google.