One scene, two matched prompts: the image prompt makes the frame, the video prompt animates it — character and aspect identical in both.
La característica principal del pipeline Dreamer: a partir de una escena en lenguaje natural, un prompt de imagen + video emparejado en un solo paso. El paso 1 genera la imagen, el paso 2 la anima. En caso de diálogo, en lugar de texto a video, se realiza sincronización labial sobre la imagen fija mantenida.
Más en el léxico
Términos relacionados
Pon a prueba
Cuestionario
1. Zu welchem Department gehört „Image-to-Video Matched Pair"?