Blog/tutorials·9. Sept. 2026·6 Min.·vom eroq-Team
Podcast-Intro mit KI-Stimme – ein Cold Open, das sitzt
Schreib Cold Open und Show-ID fürs Ohr, steuere den Vortrag mit Satzzeichen, wähl eine Stimme und leg die MP3 in deinem Editor unter ein Musikbett.
Die ersten fünfzehn Sekunden eines Podcasts entscheiden, ob es die nächsten vierzig Minuten überhaupt gibt. Die meisten Shows verbringen sie mit einem Logo-Jingle und einem Namen – das akustische Gegenstück dazu, einen Film mit der Tafel der Produktionsfirma zu eröffnen. So schreibst und renderst du die zwei Teile, die wirklich funktionieren – ein Cold Open und eine Show-ID –, in ungefähr der Zeit, die ein Kaffee braucht.
Eins vorab, damit du die Session richtig planst: eroq rendert Sprache, keine Shows. Es gibt keine Timeline, keine Musikgenerierung und kein Mischpult. Zurück bekommst du eine MP3, und das Musikbett legst du in dem Editor darunter, den du ohnehin nutzt.
Zwei Teile, zwei verschiedene Aufgaben
Ein Cold Open beginnt mitten im Gedanken. Keine Begrüßung, kein Name, kein Kontext – ein Satz aus der Mitte der Folge, nach dem die Hörer die Minute drumherum unbedingt hören wollen. Es dauert acht bis fünfzehn Sekunden und wird für jede Folge neu geschrieben.
Eine Show-ID ist das, was sich nie ändert. Name der Show, worum es geht, wer sie macht, und raus. Höchstens zehn Sekunden, einmal gerendert und ein Jahr lang wiederverwendet.
Die beiden scheitern in entgegengesetzte Richtungen. Cold Opens scheitern, weil sie erklären. Show-IDs scheitern, weil sie interessant sein wollen. Schreib sie getrennt, render sie getrennt und schneide sie in deinem Editor mit dem Musikbett zusammen.
Schreib fürs Ohr – das ist etwas anderes als fürs Papier
- Ein Gedanke pro Satz, und kurze Sätze. Wer zuhört, kann nicht zurückblättern.
- Das Subjekt nach vorn. Nebensätze, die vor der Pointe kommen, gehen im Audio verloren.
- Schreib Zahlen so, wie du sie sprichst. „Neunzehnhundertsechsundneunzig“, nicht „1996“. „Rund dreitausend Dollar“, nicht „$3,000“.
- Namen früh, und nur einmal. Ein Name, der erst im letzten Satzteil auftaucht, bleibt nicht hängen.
- Keine Klammern, keine Semikolons. Braucht ein Gedanke Klammern, braucht er einen eigenen Satz.
- Lies es laut, bevor du es renderst. Wenn du stolperst, stolpert die Engine auch.
Die Satzzeichen sind deine Regieanweisungen. Die Sprach-Engines setzen Kommas, Auslassungspunkte, Gedankenstriche und Satzlänge in Vortrag um – ein eigenes Markup gibt es nicht –, also schreib die Pausen hinein, statt auf sie zu hoffen.
Ein Cold Open zum Klauen
Geschrieben für eine Show mit True-Crime-Einschlag, aber die Form passt auf alles:
Sie unterschrieb die letzte Seite um vier Uhr nachmittags. Um sechs war das Gebäude leer, die Server waren gelöscht, und die Firma, die es am Morgen noch gegeben hatte, gab es nicht mehr.
Angeklagt wurde nie jemand.
Das ist die Geschichte der neunzig Minuten dazwischen.
Schau, was die Satzzeichen machen. Die Aufzählung mit Kommas im ersten Absatz beschleunigt. Der einzeilige Absatz danach landet wie ein Punkt mit Luft drumherum. Die letzte Zeile ist kurz, weil die Hörer sich da schon vorbeugen sollten, statt informiert zu werden.
Eine Show-ID zum Klauen
Nightline Files. Wahre Geschichten über die Stunde, in der niemand hinsah.
Neue Folgen jeden Donnerstag – mit Dana Ruiz.
Zehn Sekunden, keine Adjektive, die die Arbeit des Vortrags übernehmen, und ein Gedankenstrich, wo ein Atemzug hingehört.
Hängst du am Skript fest, entwirf es zuerst im Tool „Text“ – der Stil „Szene“ schreibt Prosa, die zum Vorlesen gedacht ist, und eine Antwort kostet 3 Credits mit RP+ oder 1 mit RP mini, also weniger als eine Stunde Löcher in die Luft starren.
Stimme wählen, dann zwei Regler einstellen
Die Stimmauswahl besteht aus zwei Stimmen, besetzt für unterschiedliche Tonlagen. Aria ist warm und nah – sie geht dicht ans Mikro, und genau das will ein Cold Open. Orion ist tief und gelassen und klingt nach Nachtradio, und genau das will eine Show-ID. Beide sprechen 13 Sprachen. Hat die Show einen Host, ist ein Klon seiner eigenen Stimme die bessere Wahl für die ID, denn das Publikum soll sie wiedererkennen.
Dann die beiden Regler neben dem Modell:
- Cold Open, Aria – Tempo 1,00, Ausdruck 65%. Die Satzzeichen tragen das Drama, der Regler muss es nur zulassen.
- Show-ID, Orion – Tempo 0,95, Ausdruck 35%. Etwas langsam, bewusst flach. Eine aufgeregte Senderkennung klingt nach Werbung.
Verändere immer nur einen Regler. Ab etwa 80% Ausdruck spielt die Stimme Satzzeichen aus, die du so nicht gemeint hast, und ein Tempo unter 0,85 macht aus Würde Betäubung. Der volle Bereich reicht beim Tempo von 0,70× bis 1,30× und beim Ausdruck von 0 bis 100%.
Rendern – und was das kostet
Öffne das Tool „Stimme“, füg das Cold Open ein, wähl die Stimme, stell die Regler ein, generiere und lade die MP3 herunter. Solange du noch an Sätzen feilst, iterierst du mit Voice Turbo für 2 Credits pro 100 Zeichen; den finalen Durchgang machst du mit Voice One für 3.
Die Rechnung ist so klein, dass du sie ignorieren kannst – genau darum geht es. Abgerechnet werden angefangene Blöcke von 100 Zeichen: Das Cold Open oben hat etwa 260 Zeichen, also 3 Blöcke oder 9 Credits mit Voice One. Die Show-ID hat etwa 120 Zeichen, also 2 Blöcke oder 6 Credits. Beide fünfzehnmal zu rendern, während du am Text feilst, macht 225 Credits, gut zwei Dollar zum Preis des Einstiegspakets, und die 50 Gratis-Credits eines neuen Kontos decken die ersten drei Durchgänge komplett ab.
Jeder Render landet automatisch in deiner Bibliothek – die Show-ID aus dem März ist also im September noch da, wenn du das Intro neu bauen musst.
Unter ein Musikbett legen – in deinem Editor
Diesen Schritt übernimmt eroq nicht, und so zu tun, als ob, würde dich eine Stunde kosten. Hol die MP3 in Reaper, Audition, Audacity oder Premiere – was immer du schon hast – und bau das Intro dort:
- Die Stimme auf eine eigene Spur, das Musikbett auf eine andere, die Musik von dort, wo du sie sonst auch lizenzierst.
- Senk das Bett unter der Stimme um sechs bis zehn Dezibel ab, mit kurzem Fade-in und längerem Fade-out.
- Lass das Bett etwa eine Sekunde vor dem ersten Wort beginnen und zwei Sekunden über das letzte hinaus laufen.
- Lass zwischen Cold Open und Show-ID einen Moment Stille. Diese Lücke leistet mehr als jeder Jingle.
- Exportier mit deinem üblichen Lautheitsziel und hör es auf Smartphone-Lautsprechern gegen – dort hört der Großteil deines Publikums.
Für die Videoseite derselben Folge zeigt KI-Video für Podcast-Clips, wie aus dem Audio etwas Postbares wird, und KI-Stimmen für Hörbücher und Podcasts liefert die Credit-Rechnung für lange Formate, wenn du ganze Segmente einsprechen lässt statt nur ein Intro. Der Anwendungsfall Hörbücher und Podcasts ist die Kurzfassung von beidem.
Häufige Fragen
Kann ich das Musikbett auch in eroq machen?
Nein. Es gibt keine Musikgenerierung und keine Timeline – die Stimmmodelle liefern eine MP3, und gemischt wird in deinem eigenen Editor. Besorg das Musikbett wie gewohnt und senk es dort unter der Stimme ab.
Sollte ich für ein Podcast-Intro eine geklonte Stimme oder eine Studio-Stimme nehmen?
Nimm einen Klon, wenn das Publikum den Host wiedererkennen soll, und eine Studio-Stimme, wenn das Intro eher nach Stationssprecher als nach einer Person klingen soll. Aria passt zu persönlichen Cold Opens, Orion zu Show-IDs, und beide funktionieren mit beiden Sprachmodellen.
Wie lang sollte ein Cold Open sein?
Acht bis fünfzehn Sekunden, also grob 200 bis 350 Zeichen Skript. Ist es länger, hört es auf, ein Hook zu sein, und wird zur Folge selbst – und für die ist der Hörer ohnehin gekommen.
Wie bringe ich die Stimme dazu, zwischen zwei Zeilen eine Pause zu machen?
Mit Satzzeichen und Absätzen – ein Punkt stoppt, Auslassungspunkte lassen ausklingen, ein Gedankenstrich schneidet ab, und ein neuer Absatz wirkt wie eine größere Trennung. Einen Pausen-Tag gibt es nicht; brauchst du eine exakte Lücke, schneide sie in deinem Editor.
Skript fertig? Öffne das Tool „Stimme“ und render zuerst das Cold Open – es entscheidet, ob der Rest gehört wird.
Mach das mit den Modellen hinter diesem Artikel – starte mit 50 Gratis-Credits oder sieh dir alle Engines und ihre Preise an.