Video
Lip-Sync
Lip-Sync (Lippensynchronisation) animiert ein Gesicht so, dass der Mund zu einer von dir gelieferten Tonspur passt. Damit wird aus einem stillen Porträt oder einem stummen Clip jemand, der scheinbar deine Worte spricht.
Das ist eine eigenständige Fähigkeit, getrennt von der Videogenerierung: Das Modell wird auf die Audio-Wellenform konditioniert und steuert die Mundformen Frame für Frame. Tools, die das anbieten, nehmen in der Regel ein Gesicht plus eine Sprachdatei entgegen und liefern einen neuen Clip.
Sprache direkt in der Einstellung zu generieren ist etwas völlig anderes – dort erfindet die Engine Darbietung und Ton gemeinsam, aus dem Prompt und bei manchen Engines aus einer Stimmprobe, und nichts wird an eine von dir gelieferte Tonspur angepasst.
Auf eroq
eroq hat kein Lip-Sync-Tool. Engines mit Ton können eine gesprochene Zeile als Teil des Clips rendern – Veo 3.1 rendert Dialoge, und bei Seedance und Hailuo 3 wird die Stimmprobe eines Charakters mitgegeben –, aber du kannst keine separate Sprachspur über einen bestehenden Clip legen und den Mund passend dazu bewegen lassen. Sprechertext aus dem Tool „Stimme“ legst du in deinem eigenen Schnittprogramm unter das Bild.
Fragen
Kann eroq einen Charakter mein Skript sprechen lassen?
Nicht mit passenden Mundbewegungen. Du kannst die Stimme aus deinem Skript im Tool „Stimme“ rendern, das Bild separat, und beides dann in einem Schnittprogramm kombinieren – das Gesicht ist dabei nicht synchron.
Was macht Veo 3.1 eigentlich mit Dialogen?
Es generiert die Zeile als Teil der Einstellung, samt Stimme, aus deinem Prompt. Die Stimme wählst du nicht aus, und das Audio kannst du nicht vorgeben – es eignet sich also eher für beiläufige Sprache als für geskriptete Erzählung.
Steht Lip-Sync auf der Roadmap?
Wir veröffentlichen keine Roadmap-Versprechen. Stand heute gibt es keinen Endpoint und keine Studio-Funktion, die das kann.
Weitere Begriffe: Video