Gemini Omni 1.1 Flash: extensión de 40 segundos y control de fotogramas

⏱ Tiempo de lectura: 3 min
Google actualizó Gemini Omni 1.1 Flash, su modelo nativo de generación y edición de video multimodal en producción. La actualización amplía la extensión de escenas a 10 segundos de contexto previo en lugar de un único fotograma final, permite fijar fotogramas iniciales y finales para controlar el movimiento de cámara, y acepta clips de video como referencias para mantener consistencia de personajes.
Mejoras en extensión de escenas y control de video
La extensión de escenas ahora lee hasta 10 segundos de contexto anterior en lugar de depender de un único fotograma final, lo que permite generar continuaciones más coherentes. Los usuarios pueden fijar el primer y último fotograma para controlar explícitamente el movimiento de cámara durante la generación. Los clips de video pueden pasarse como referencias para garantizar que los personajes mantengan coherencia visual a lo largo de las extensiones. Estas mejoras refuerzan las capacidades de generación de video en producción.
Funcionalidades confirmadas y detalles técnicos
La actualización incluye upscaling a 4K, extensión de escenas de hasta 40 segundos, lectura de 10 segundos de contexto anterior, control de fotogramas inicial y final, y uso de clips de video como referencias de personajes. Gemini Omni 1.1 Flash opera como modelo nativo multimodal optimizado para producción. No se especifican en el texto fuente recibido: fecha exacta de disponibilidad general, plataformas específicas de acceso (web, API, aplicación móvil), límites de uso por sesión, o precios de acceso. Fuente: www.marktechpost.com
| Función | Detalle |
|---|---|
| Modelo | Gemini Omni 1.1 Flash (nativo multimodal) |
| Extensión de escenas | Hasta 40 segundos con 10 segundos de contexto previo |
| Control de fotogramas | Fijar primer y último fotograma para control de cámara |
| Referencias de video | Clips de video como referencia para consistencia de personajes |
| Resolución máxima | Upscaling a 4K |
| Tipo de actualización | Actualización en producción de modelo existente |
| Disponibilidad general | No se especifica en el texto fuente recibido |
Preguntas frecuentes sobre Gemini Omni 1.1 Flash
¿Qué cambió respecto a la versión anterior?
La extensión de escenas pasó de depender de un único fotograma final a leer hasta 10 segundos de contexto anterior. Se agregaron controles de fotograma inicial y final, y se permite usar clips de video como referencias de personajes. También incluye upscaling a 4K.
¿Cuándo está disponible esta actualización?
No se especifica la fecha exacta de disponibilidad general en el texto fuente recibido. Se describe como actualización en producción, lo que sugiere que ya está en despliegue, pero no se confirman fechas precisas de acceso público.
¿Está disponible para todos los usuarios?
No se detalla en la fuente recibida. No se especifican plataformas de acceso (web, API, aplicación móvil), tiers de suscripción, regiones, o si requiere invitación. Se menciona que es actualización en producción del modelo nativo multimodal.
Contexto e impacto en edición de video con IA
La actualización refleja el avance en control fino de generación de video. El uso de 10 segundos de contexto en lugar de un fotograma mejora la continuidad narrativa. El control de fotogramas inicial y final permite directores y creadores una mayor precisión en movimiento de cámara sin post-procesamiento.
En Inteligencia Artificial, estas mejoras apuntan a hacer la generación de video más útil en flujos de producción reales, donde la consistencia de personajes y el control de cámara son críticos. ¿Cómo impactará el acceso a estas herramientas en la producción de contenido independiente?
Fuente: www.marktechpost.com

Deja una respuesta
Lo siento, debes estar conectado para publicar un comentario.