Vom geschriebenen Skript zum Podcast-Audio mit mehreren Stimmen

Breeze Blue führt das Podcast-Skript auf, das du bereits geschrieben hast. Gib jedem Host und Gast eine unverwechselbare KI-Stimme, regissiere Tempo und Ton jeder Zeile in natürlicher Sprache und exportiere das fertige Audio in deinen gewohnten Schnitt.

Eine eigene Stimme für jeden Host und jeden Gast

Ein Podcast funktioniert, wenn Hörer die Stimmen auseinanderhalten können. Baue dein Ensemble aus drei Quellen: aus der Library wählen, eine Stimme aus einer Beschreibung entwerfen oder deine eigene klonen.

Aus der Voice Library wählen

Stöbere in einer kuratierten Library, in der jede Stimme eine eigene Persönlichkeit und eine abspielbare Hörprobe hat. Kombiniere einen warmen, ruhigen Host mit einem schnelleren, pointierteren Co-Host — so ist immer klar, wer gerade spricht.

Öffentliche Voice Library entdecken

Co-Host aus einer Beschreibung entwerfen

Beschreibe die Stimme, die deiner Show fehlt — Alter, Haltung, Energie — und höre in Sekunden generierte Kandidaten an. Passt eine, speicherst du sie, und sie wird ein wiederverwendbares Mitglied deines Ensembles.

Podcast-Stimme aus einer Beschreibung entwerfen

Deine eigene Host-Stimme klonen

Mache aus einer kurzen, autorisierten Aufnahme deiner Stimme — MP3 oder WAV, mindestens 5 Sekunden — eine wiederverwendbare geklonte Stimme, mit ausdrücklichem Einwilligungsschritt. Wir analysieren die ersten 60 Sekunden und behalten die besten 30 zum Klonen. Schreib die Folge, und deine Stimme liest sie, auch wenn du keine Zeit zum Aufnehmen hast.

So funktioniert autorisiertes Voice Cloning

Regissiere jede Zeile wie ein Showrunner

Die Stimme bestimmt, wer spricht; die Regie bestimmt, wie eine Zeile wirkt. Schreibe Anweisungen in natürlicher Sprache — für die ganze Folge oder eine einzelne Zeile — und die Stimme setzt sie um: Tempo, Ton, Zögern, Energie.

Aus einer geskripteten Folge

HostWarm und gelassen, begrüßt die Hörer zurück

Willkommen zurück. Die heutige Geschichte beginnt mit einem Anruf, mit dem niemand gerechnet hat.

GastNachdenklich, zögert einen Moment vor der Antwort

Ehrlich gesagt… ich war mir nicht sicher, ob ich darüber überhaupt öffentlich sprechen sollte.

HostBeugt sich vor, leiser, zieht die Hörer näher heran

Fangen wir vorne an. Was ist in jener Nacht passiert?

In unserem öffentlichen Voice-Direction-Benchmark (2026-08-17) erreichen regissierte Lesungen einen Voice Direction Score von insgesamt 4,25 bei einer Sprecherähnlichkeit von 0,67 — der Vortrag ändert sich, aber der Host klingt weiterhin wie der Host.

Gebaut für ganze Folgen, nicht für Einzeiler

Eine 40-Minuten-Folge ist ein langes Skript. Produziere sie in Abschnitten, korrigiere einzelne Zeilen, ohne alles neu zu rendern, und halte jede Stimme vom Cold Open bis zum Outro konsistent.

1

Skript einfügen

Bring das Folgen-Skript mit, das du schon geschrieben hast — Intro, Segmente, Werbetexte, Outro. Teile es nach Sprecher und Abschnitt, sodass jeder Block seine eigene Stimme und Regie trägt.

2

Stimmen den Sprechern zuweisen

Ordne jedem Host und Gast eine Stimme aus deinem Ensemble zu. Eine gespeicherte Stimme klingt in Folge eins wie in Folge hundert — deine Show behält ihren stabilen Klang.

3

Abschnitt für Abschnitt generieren

Arbeite dich in Segmenten durchs Skript. Höre rein, passe die Anweisung einer Zeile an, die nicht sitzt, und generiere nur diese Zeile neu — ohne die ganze Folge zu wiederholen.

4

Exportieren und wie gewohnt schneiden

Lade das fertige Audio herunter und baue es im Editor mit Musik, Werbeplätzen und Mischung zusammen — veröffentlicht wird über deinen gewohnten Hosting-Workflow.

Was Breeze Blue macht — und was nicht

Breeze Blue ist kein End-to-End-Podcast-Tool: Es plant keine Folgen, nimmt keine Live-Gespräche auf, hostet deinen Feed nicht und veröffentlicht nicht auf Plattformen. Es macht eine Sache richtig gut: dein geschriebenes Skript als regissiertes Sprach-Audio aufzuführen, das du in deinen normalen Schnitt- und Publishing-Workflow übernimmst.

Folgen exportieren und kommerziell nutzen

Das Ergebnis ist Standard-Audio — bereit für jeden Editor, jeden Workflow, jedes Hosting.

Saubere Dateien für den Schnitt

In Text to Speech und Studio generiertes Audio lädt als WAV herunter — der Schnitt startet mit unkomprimiertem Material; Stimm-Hörproben aus der Library laden als MP3.

Kommerzielle Nutzung

Auf Bezahlplänen generiertes Audio darf in kommerziellen Projekten eingesetzt werden — auch in monetarisierten Podcasts, Branded Shows und den Werbetexten deiner Folgen.

Kostenlos starten

Starte kostenlos und sichere dir täglich Gratis-Credits; wächst dein Veröffentlichungsrhythmus, wechselst du auf einen Bezahlplan mit mehr monatlichen Credits.

Häufige Fragen

Plant, produziert, hostet oder veröffentlicht Breeze Blue meinen Podcast?

Nein — und das ist Absicht. Breeze Blue verwandelt dein geschriebenes Skript in aufgeführtes Sprach-Audio. Planung, Live-Aufnahme, Feed-Hosting und Distribution bleiben in den Tools, die du bereits nutzt; du übernimmst nur das exportierte Audio in diesen Workflow.

Kann jeder Host und jeder Gast eine andere Stimme haben?

Ja. Weise jedem Sprecher im Skript eine eigene Stimme zu — aus der Library gewählt, aus einer Textbeschreibung entworfen oder aus deiner eigenen autorisierten Aufnahme geklont. Gespeicherte Stimmen sind wiederverwendbar, dein Ensemble bleibt über Folgen hinweg konsistent.

Kann ich meine eigene Stimme für meine Show klonen?

Ja, aus einer kurzen autorisierten Probe: Web und API akzeptieren MP3 oder WAV mit mindestens 5 Sekunden, mit ausdrücklicher Einwilligungserklärung. Wir analysieren die ersten 60 Sekunden und behalten die besten 30 zum Klonen. Du darfst nur Stimmen klonen, an denen du die Nutzungsrechte hast.

Wie steuere ich Tempo, Ton und Emotion Zeile für Zeile?

Schreibe die Regieanweisung in natürlicher Sprache neben die Zeile — „langsamer, fast ein Flüstern, als würdest du ein Geheimnis teilen“ — und die Stimme setzt sie um. Für einzelne Momente formen kurze Klammer-Hinweise wie [sigh] die Darbietung innerhalb einer Zeile.

Wie geht das Tool mit dem Skript einer ganzen Folge um?

Lange Skripte produzierst du in Segmenten: einen Abschnitt generieren, anhören und nur die Zeilen neu generieren, die eine andere Lesart brauchen. Da die Stimme jedes Sprechers ein gespeichertes Asset ist, bleiben die Stimmen einer 40-Minuten-Folge vom ersten bis zum letzten Segment konsistent.

Darf ich das Audio in einem monetarisierten Podcast verwenden?

Auf Bezahlplänen generiertes Audio darf kommerziell genutzt werden, auch in monetarisierten und gesponserten Shows. Die Details der einzelnen Pläne findest du auf unserer Preisseite.

Welches Audio bekomme ich, und wie kommt es in meinen Editor?

Generierungen aus Text to Speech und Studio laden als WAV herunter — du ziehst sie direkt in jeden Editor, ergänzt dort Musik, Werbeplätze und Mischung und veröffentlichst anschließend über dein gewohntes Hosting.

Kann ich Podcast-Stimmen kostenlos ausprobieren?

Ja. Mit der Demo auf dieser Seite regissierst du eine Stimme ganz ohne Konto, und die Registrierung ist kostenlos — mit täglich abrufbaren Gratis-Credits. Bezahlpläne ergänzen mehr monatliche Credits und Stimm-Slots, wenn deine Produktion wächst.