One scene, two matched prompts: the image prompt makes the frame, the video prompt animates it — character and aspect identical in both.
La fonctionnalité principale du pipeline Dreamer : à partir d'une scène en langage naturel, une paire d'invites Image + Vidéo correspondantes en une seule étape. L'étape 1 génère l'image, l'étape 2 l'anime. En cas de dialogue, au lieu de Text-to-Video, synchronisation labiale sur l'image fixe conservée.
Continuer dans le lexique
Termes liés
Teste tes connaissances
Quiz
1. Zu welchem Department gehört „Image-to-Video Matched Pair"?