Loading...
Loading...
Convierte imágenes de referencia en vídeos dinámicos
Referencia a vídeo usa una o varias imágenes como guía en lugar de como primer fotograma literal. La referencia le dice al modelo qué aspecto debe tener un sujeto, un personaje o un estilo visual, y el prompt describe el clip que hay que construir a su alrededor. El resultado no tiene por qué empezar con tu imagen; tiene que parecer que va con ella.
Esa distinción importa cuando necesitas coherencia entre varios clips. Un personaje recurrente, un producto con una forma concreta o un estilo de casa se mantienen mucho mejor entre planos si alimentas la misma referencia cada vez que si vuelves a describirlos con palabras. Las referencias limpias funcionan mejor, con el sujeto claramente visible y el fondo tranquilo, porque una fotografía cargada le da al modelo demasiadas señales en competencia sobre qué debe conservar.
En E2X esta categoría la sirven Veo 3.1 Fast y Omni Flash de Google. Ambos usan la misma forma de llamada que todo lo demás del catálogo: envía un slug de modelo con tu objeto de entrada al endpoint de trabajos y consulta el id del trabajo que devuelve. Las solicitudes se facturan una a una contra un saldo prepago, así que probar la misma referencia con los dos modelos son dos solicitudes y nada más.
Imagen a vídeo convierte tu imagen en el primer fotograma del clip. Referencia a vídeo trata la imagen como una guía de sujeto o de estilo, y el clip no tiene por qué empezar en ella.
Una toma clara y bien iluminada en la que el sujeto no esté tapado y el fondo no compita por la atención. Cuanto más limpia sea la referencia, con más previsibilidad la traslada el modelo.
Para eso está la categoría. Reutilizar una misma referencia entre generaciones mantiene un sujeto con mucha más coherencia que volver a describirlo en cada prompt.
Una solicitud contra tu saldo prepago, al precio por solicitud que muestra el modelo en el catálogo.