Eine Szene, zwei gematchte Prompts: Image-Prompt erzeugt das Bild, Video-Prompt animiert es — Charakter und Aspect wortgleich in beiden.
Das Kern-Feature der Dreamer-Pipeline: aus einer Plain-Sprache-Szene ein gematchtes Image- + Video-Prompt in einem Schritt. Step 1 erzeugt das Bild, Step 2 animiert es. Bei Dialog statt Text-to-Video Lip-Sync auf das gehaltene Still.
Im Lexikon weiter
Verwandte Begriffe
Wissen testen
Quiz
1. Zu welchem Department gehört „Image-to-Video Matched Pair"?