Blog/use-cases·31. Aug. 2026·5 Min.·vom eroq-Team
KI-Video für Online-Kurse: B-Roll, Intros und geklonte Stimme
Intros, B-Roll und geklonte Sprecherstimme für einen ganzen Kurs auf eroq: ein Look über alle Lektionen und die Credit-Rechnung für ein Modul.
Die unglamouröse Wahrheit beim Aufnehmen eines Kurses: Die Lektionen sind der leichte Teil. Den Stoff kennst du. Was die Wochen frisst, ist alles drumherum: ein Intro, das nicht nach Vorlage von 2014 aussieht, B-Roll für die vier Minuten, in denen du vor einer statischen Folie eine Abstraktion erklärst, Titelkarten, die über vierzig Lektionen zusammenpassen, und eine Neuaufnahme von Lektion sechs, weil du dir mitten im Modul eine Erkältung eingefangen hast. Generiertes Video und generierte Sprache sind genau in dieser Schicht drumherum stark und ungeschickt in der Schicht, in der du ohnehin schon gut warst.
Wofür generiertes Video in einer Lektion da ist
Zieh die Grenze, bevor du irgendetwas ausgibst.
Gute Einsätze: das fünfsekündige Intro, der Establishing Shot hinter einem Abschnittstitel, die visuelle Metapher, während du ein Konzept erklärst, der Übergang zwischen Kapiteln, das Standbild hinter einem Zitat, das Titelbild für die Verkaufsseite.
Schlechte Einsätze: alles, was vorgibt, du zu sein. eroq hat kein Lip-Sync, keinen sprechenden Avatar und kein Training eines Modells auf deinem eigenen Material. Ein generierter Moderator ist also ein fiktiver Fremder, dessen Mund nicht zu deinen Worten passt. Deine Kamera bleibt das Gesicht des Kurses. Das Einzige, was deine Identität wirklich tragen kann, ist deine Stimme, und die ist ein Klon, keine Marionette.
Außerdem gut zu wissen, bevor du deine Planung darauf aufbaust: eroq rendert Clips, und das war's. Trimmen, Übergänge und Color Grading passieren in deinem Schnittprogramm.
Ein Look für den ganzen Kurs
Ein Kurs wirkt amateurhaft, wenn Lektion eins warm und filmisch ist und Lektion neun kalt und digital. Drei Mechanismen halten vierzig Lektionen in einer visuellen Familie.
Ein Stil-Element. Elemente ist eine Bibliothek wiederverwendbarer Orte, Objekte und Stile, bis zu 50, jeweils per @-Erwähnung im Prompt abrufbar. Leg deinen Kurs-Look einmal als Stil-Element an und setz die @-Erwähnung in jeden Render, statt fünf Einstellungen im Regiepult neu einzugeben und zu hoffen, dass du dich richtig erinnerst.
Das Regiepult. Es wird auf dem Server in den Prompt eingebaut, deine Identität ist also ein Preset statt Prosa, die du jedes Mal neu improvisierst: Filmart „Dokumentarfilm“, Epoche „2010er“, Tempo „Ruhig“, Kamera „35-mm-Film“, Farbpalette „Nostalgisches Blau“ und Licht „Weiches Kreuzlicht“ ergeben einen stimmigen Hausstil. Änderst du ihn einmal, zieht jede künftige Lektion mit.
Ein Seed. Die Seedance-Engines berücksichtigen einen Seed für Reproduzierbarkeit. Das Intro, das dir in Lektion eins gefallen hat, lässt sich also mit neuem Motiv und gleichem Charakter neu rendern, statt dass du es per Zufall wiederfinden musst.
Der Intro-Prompt
Ein fließender Absatz: erst das Motiv, dann die Bewegung, dann die Kamera, dann das Licht, dann die Stimmung:
Ein leerer Hörsaal im Morgengrauen aus der letzten Reihe gesehen, langsame Ranfahrt den Mittelgang hinunter, während blasses blaues Licht durch hohe Fenster steigt und Staub in den Lichtstrahlen kreist, Reihen von Holzsitzen in weicher Unschärfe, Objektiv gestochen scharf bei f/4, Farbpalette in nostalgischem Blau, weiches Kreuzlicht, ruhiges Tempo, Dokumentarlook auf 35-mm-Film, Totalaufnahme.
Tausch pro Modul die Motivzeile aus und behalte alles nach dem ersten Komma. Das ist der ganze Trick für einen einheitlichen Kurs: Die Grammatik bleibt, das Substantiv wechselt.
Für Lektionen, die eine Sequenz statt eines einzelnen Clips brauchen, baut der Cinema-Modus im Tool „Video“ ein Storyboard Schritt für Schritt auf: Du fügst Szenen einzeln hinzu, bis zu 12, jede wird sofort gerendert, mit ×1–4 Takes pro Szene und der Möglichkeit, jede davon zu bearbeiten, neu zu rendern, umzusortieren oder zu duplizieren. Entwürfe landen unter „Deine Filme“, die Überarbeitung im nächsten Jahr startet also beim Storyboard von diesem Jahr.
Sprechertext mit deiner eigenen Stimme
Das Tool „Stimme“ macht Text-zu-Sprache mit einer kuratierten Auswahl an Stimmen (Aria klingt warm und nah, Orion tief und ruhig, dreizehn Sprachen) und klont außerdem eine Stimme aus deinen eigenen Aufnahmen, und genau das wollen die meisten Kursersteller. Nimm den Klon einmal auf, und Lektion sechs bekommt ihre Neuaufnahme, ohne dass du erst deine Erkältung auskurieren musst.
Zwei Modelle, dieselben Stimmen und dieselben Klone: Voice Turbo für 2 Credits pro 100 Zeichen und Voice One, das ausdrucksstarke Flaggschiff, für 3 Credits pro 100. Bewährt hat sich: jede Lektion als Entwurf mit Turbo rendern, anhören, das Skript korrigieren und dann die finale Fassung mit Voice One rendern. Die Betonung steuern Satzzeichen und die Regler für Tempo und Ausdruck, die Korrektur für einen flachen Satz ist also meist ein Komma und kein neuer Render auf einer anderen Engine. Mehr dazu auf der Seite zum Stimmklonen.
Was ein Modul mit zehn Lektionen kostet
Ein Modul: ein Intro pro Lektion, zwei B-Roll-Clips pro Lektion, je eine Titelkarte und Sprechertext. Clips mit 5 Sekunden auf Seedance 1.0 Lite für 120 Credits, Standbilder mit Image One für 10, Sprechertext mit 6.000 Zeichen pro Lektion (ungefähr tausend Wörter) mit Voice Turbo:
- Intros – 10 × 120 = 1.200
- B-Roll – 20 × 120 = 2.400
- Titelkarten – 10 × 10 = 100
- Sprechertext – 60.000 ÷ 100 × 2 = 1.200
Insgesamt 4.900 Credits, etwa $49 zum Preis des Einstiegspakets von $10 für 1.000 Credits. Renderst du den finalen Sprechertext stattdessen mit Voice One, sind es 60.000 ÷ 100 × 3 = 1.800, und das Modul landet bei 5.500.
So oder so deckt ein Monat Creator für $49 mit 6.000 Credits ein ganzes Modul ab, und es bleibt genug für einen zweiten Durchgang bei der Hälfte der Lektionen. Hobby für $15 mit 1.800 Credits reicht für ungefähr ein halbes Modul im Monat. Das passt, wenn du alle zwei Monate ein Modul veröffentlichst und das Guthaben stehen lässt, denn Credits verfallen nie. Fehlgeschlagene Renders werden automatisch erstattet, ein misslungener Durchgang kostet dich also einen Abend.
Der Zusammenbau und der Teil, den eroq nicht übernimmt
Alles, was du renderst, wird mit seinem vollständigen Rezept in deiner Bibliothek gespeichert, und Remix lädt dieses Rezept zurück ins Tool: So startet Lektion elf bei Lektion zehn. „Animieren“ macht aus einem Standbild, das dir gefällt, die Quelle für einen Bild-zu-Video-Clip, und das ist der günstigste Weg, Bewegung in eine bereits abgenommene Titelkarte zu bringen.
Dann exportierst du. Der Zusammenbau des Kurses (Timeline, Untertitel, Quizze, der Upload ins LMS) passiert dort, wo er schon immer passiert ist. Dieselbe Arbeitsteilung, von der anderen Seite betrachtet, beschreibt der Anwendungsfall Faceless-YouTube-Kanäle, bei dem die generierte Schicht noch mehr Arbeit übernimmt.
Häufige Fragen
Kann ich ein Video von mir beim Unterrichten erstellen, ohne zu filmen?
Nein. eroq generiert originale, fiktive Menschen, es gibt kein Lip-Sync und keinen Avatar, der deine Worte spricht, und ein Modell auf deinem eigenen Material zu trainieren, ist keine Funktion. Klon deine Stimme, film dein Gesicht.
Wie viele Credits braucht Sprechertext wirklich?
Abgerechnet wird pro Zeichen, nicht pro Wort oder Minute. Voice Turbo kostet 2 Credits pro 100 Zeichen, Voice One 3. Eine Lektion mit tausend Wörtern hat rund 6.000 Zeichen, also 120 Credits mit Turbo und 180 mit Voice One.
Wie halte ich vierzig Lektionen optisch einheitlich?
Speichere den Look als Stil-Element, bleib bei einem Preset im Regiepult und verwende auf den Seedance-Engines einen Seed wieder. Ändere das Motiv im Prompt, nie die Grammatik dahinter.
Du schreibst diese Woche Modul eins? Öffne das Tool „Stimme“, klon zuerst deine Stimme und lass die Intros dem Skript folgen.
Mach das mit den Modellen hinter diesem Artikel – starte mit 50 Gratis-Credits oder sieh dir alle Engines und ihre Preise an.