Una scena, due prompt appaiati: quello immagine crea il fotogramma, quello video lo anima — personaggio e rapporto d'aspetto identici in entrambi.
La funzionalità principale della pipeline Dreamer: da una scena in linguaggio naturale a un prompt Image + Video corrispondente in un unico passaggio. Il passaggio 1 genera l'immagine, il passaggio 2 la anima. In caso di dialogo, invece di Text-to-Video, Lip-Sync sul fermo immagine mantenuto.
Continua nel lessico
Termini correlati
Metti alla prova
Quiz
1. Zu welchem Department gehört „Image-to-Video Matched Pair"?