
Google ha lanzado su modelo de generación de vídeo Gemini Omni 1.1 Flash para desarrolladores a través de la Gemini API y Google AI Studio, según ha anunciado en el Google Blog. Si desarrollas flujos de trabajo de vídeo, esta actualización te ofrece un control mucho más preciso sobre clips cortos sin salir del entorno de desarrollo de Google.
Qué ofrecen los nuevos controles
En lugar de escribir un prompt y cruzar los dedos, ahora puedes dirigir el resultado con herramientas específicas:
- Amplía escenas paso a paso. El modelo lee hasta 10 segundos de contexto previo y añade extensiones de 10 segundos, alcanzando hasta 40 segundos en total.
- Fija fotogramas iniciales y finales. Los controles de primer y último fotograma te ayudan a crear cortes visuales limpios y predecibles.
- Guía el estilo con clips de referencia. Puedes subir un vídeo corto de hasta 3 segundos para guiar el movimiento de cámara o la estética.
- Exporta en alta resolución. Una vez que los borradores se ven bien, puedes renderizar los resultados finales a 1080p o 4K.
- Genera borradores rápidos. Las nuevas vistas previas en borrador a 360p te permiten probar ideas antes de pagar por renderizados completos.
Los desarrolladores pueden acceder al modelo (gemini-omni-1.1-flash) en Google AI Studio y en la Gemini API, junto con nueva documentación y material de cookbook. También se conecta a Gemini Enterprise Agent Platform. Además, Google Flow incorpora el modelo para usuarios de AI Plus, Pro y Ultra en todo el mundo, y la app Gemini añade la extensión de escenas a nivel global.
Las cifras de las que aún no deberías fiarte
Google afirma que sus vistas previas a 360p son hasta un 60% más rápidas y cuestan un tercio que a 720p estándar, según pruebas de rendimiento del sistema. Esos datos proceden en su totalidad de benchmarks internos de Google. Nadie fuera de la empresa los ha comprobado todavía, y los expertos independientes aún deben verificar la calidad, la fiabilidad, el comportamiento de seguridad y el coste total en cargas de trabajo reales de clientes. Un borrador rápido ayuda, pero los borradores malos siguen siendo una pérdida de dinero.
Por qué es importante para los equipos
Este lanzamiento transforma la generación con IA en bruto en un flujo de trabajo de edición práctico. Ahora puedes crear vídeos explicativos continuos de productos, vídeos de formación y prototipos de marketing sin tener que empezar desde cero en cada intento. Eso marca una gran diferencia. Si tu equipo ya trabaja con herramientas para desarrolladores de Google, probar este modelo con tu software de vídeo actual resulta muy sencillo.
Cómo probarlo en tu flujo de trabajo
Empieza con pruebas pequeñas. Elige cinco clips de vídeo estándar que coincidan con tu trabajo habitual. Prueba la extensión de escenas más allá de la marca inicial de 10 segundos y ensaya los controles de primer y último fotograma con semillas coincidentes. Compara las vistas previas a 360p directamente con las de 720p estándar para medir velocidad, coste y número de revisiones. Después, exporta los archivos seleccionados a 1080p y 4K para inspeccionar la coherencia visual. Exige siempre una revisión humana antes de publicar cualquier clip.
Hasta que las pruebas independientes confirmen las afirmaciones de Google, considera Gemini Omni 1.1 Flash como una prueba piloto prometedora, no como una sustitución completa de tu proceso de producción.
