Crea un reparto, no solo una voz

Dale a cada personaje de tu historia una voz propia — elegida de una biblioteca, diseñada desde una descripción o clonada con permiso — y dirige cada línea como si dieras indicaciones a un actor.

Recorrido por una escena

Tres personajes, una tormenta: de la ficha de reparto a la escena final

Así se construye una escena corta de ficción sonora en Breeze Blue: cada personaje recibe una identidad de una de tres fuentes, cada línea lleva su propia dirección, y la escena se genera como clips que ordenas y exportas.

  1. 1

    Escribe la ficha del reparto

    Esboza cada personaje en una o dos líneas: edad, temperamento, cómo se mueve por el mundo. Esa ficha se convierte en tus elecciones de voz y en las direcciones de cada línea.

  2. 2

    Dale una voz a cada personaje

    Elige una identidad de la biblioteca, diseña una a partir de la descripción del personaje o clona una voz autorizada. Guarda cada una como un activo de voz con nombre.

  3. 3

    Dirige línea a línea

    Añade a cada línea una instrucción en lenguaje natural: ritmo, ánimo, subtexto. La voz conserva su identidad mientras la interpretación sigue tu dirección.

  4. 4

    Genera y exporta la escena

    Genera cada línea con la voz y la dirección de su personaje, ordena los clips en Studio y exporta la escena terminada como audio.

Mara

Biblioteca de voces

Capitana de barco, casi 60 — curtida, inquebrantable, habla con órdenes cortas.

Origen de la voz

Elegida de la biblioteca: una voz grave y arenosa, de cadencia lenta y deliberada.

«Amárralo. Esta tormenta no se lleva otro farol.»

Dirección

Grave y firme, casi un gruñido: lo ha hecho cien veces antes.

Pip

Diseño de voz

Grumete, 16 años — despierto, nervioso, habla más rápido cuando tiene miedo.

Origen de la voz

Diseñada con una sola línea: «una voz adolescente y aflautada que se acelera y se quiebra con los nervios.»

«¡Capitana, la cuerda! ¡Ya se está deshilachando!»

Dirección

Aterrado y sin aliento, con el tono subiendo al final de la línea.

Narrador

Clonación de voz

El que cuenta la historia — irónico, sin prisa, un paso por fuera de la acción.

Origen de la voz

Clonada a partir de una muestra autorizada del propio creador, para que el programa conserve el sonido de su anfitrión.

«La tormenta, según se vio, tenía sus propios planes.»

Dirección

Sereno e irónico, con una pequeña pausa antes de «planes».

La escena terminada

Cada línea se genera como su propio clip — el gruñido de Mara, el pánico de Pip, el aparte seco del narrador — con la voz guardada de su personaje y la dirección de esa línea. En Studio ordenas los clips, regeneras cualquier lectura que quieras afinar y exportas la escena como un solo archivo de audio.

Tres maneras de darle voz a un personaje

Todo reparto es una mezcla. La fuente adecuada depende de si la voz ya existe, vive solo en tu cabeza o pertenece a alguien que te ha dado permiso para usarla.

Elegir de la biblioteca de voces

La vía más rápida cuando una voz curada ya encaja. Explora voces con carácter propio — todas dirigibles —, pruébalas con tus líneas y guarda la ganadora en tu reparto.

Ideal para: papeles secundarios, narradores y sacar un borrador de escena hoy mismo.

Explorar la biblioteca pública de voces

Diseñar desde una descripción

Cuando el personaje solo existe en el papel, descríbelo — «un grumete adolescente de voz aflautada que se quiebra con los nervios» — y escucha una voz original hecha a medida. Sin audio de referencia.

Ideal para: protagonistas originales, NPC, criaturas y voces que no deben sonar como nadie.

Ver cómo funciona el diseño de voz con IA

Clonar una voz autorizada

Cuando la voz es tuya o de alguien que ha dado su consentimiento — un presentador, un actor con quien trabajas —, clónala desde una muestra breve autorizada (bastan 5 segundos de audio limpio: analizamos los primeros 60 segundos y conservamos los 30 mejores) y úsala como cualquier otra voz del reparto.

Ideal para: tu propia voz de narrador, presentadores recurrentes y actores de tu equipo.

Leer el flujo de clonación de voz

La identidad es la voz. La interpretación es la dirección.

El error más común de un reparto es confundir a quién suena un personaje con cómo dice una línea concreta. Breeze Blue separa ambas cosas a propósito.

Timbre: se decide una vez

El timbre de un personaje — el grano, el registro y la textura que lo hacen reconocible — viene de la voz que elegiste, diseñaste o clonaste. Lo decides una vez, lo guardas, y se mantiene estable desde la primera línea del episodio uno hasta la última de la temporada.

Dirección: se decide en cada línea

Todo lo demás — ritmo, ánimo, subtexto, contención — es dirección, escrita línea a línea en lenguaje natural sobre la misma voz. Mara puede gruñir una orden, murmurar una duda y romperse de pena sin dejar de ser la misma persona.

Esta separación está medida, no supuesta: en nuestro benchmark de Voice Direction (agosto de 2026), Breeze TTS 2 obtiene un 4.25 global en seguimiento de dirección manteniendo la similitud de hablante en 0.67 — la interpretación se mueve, la identidad no.

Tu reparto es un activo, no una sesión

Las voces que guardas en Breeze Blue pertenecen a tu cuenta, no a un solo proyecto. Monta el reparto una vez y llévalo a donde quieras.

Guarda cada voz con su nombre

Las voces elegidas, diseñadas y clonadas con autorización se guardan en tu colección como activos con nombre: Mara sigue siendo Mara en cada guion, episodio y reescritura.

Reutiliza en TTS y en Studio

La misma voz guardada está disponible en el texto a voz de una sola línea y en los guiones multivoz de Studio, así que una frase suelta y una escena completa parten de la misma identidad.

Invoca la misma voz desde la API

Cada voz guardada tiene un ID que puedes referenciar desde la Developer API, de modo que el reparto que montaste en el navegador actúa en tu pipeline, tu build de juego o tu render por lotes.

La reutilización es deliberada: tú decides qué voz guardada usa cada proyecto y cada línea. Breeze Blue no recompone tu reparto ni reorganiza tu colección a tus espaldas.

Monta tu reparto en la web, ejecútalo donde quieras

Studio para escenas multivoz

Escribe o pega una escena, asigna a cada línea una voz de tu reparto guardado, dirige las lecturas y exporta el audio terminado: el flujo que hay detrás del recorrido de arriba.

Voces de personaje por API

Cada voz guardada es direccionable por ID desde la Developer API: envía una línea, una voz y una dirección en lenguaje natural, y recibe en streaming el audio interpretado para juegos, agentes y pipelines por lotes.

Preguntas frecuentes

¿Qué es un generador de voces de personajes?

Un generador de voces de personajes crea una voz sintética distintiva para un personaje de ficción e interpreta sus líneas con ella. En Breeze Blue eso supone dos decisiones: una identidad — elegida de la biblioteca, diseñada desde una descripción o clonada de una muestra autorizada — y una interpretación línea a línea que diriges en lenguaje natural, como darías indicaciones a un actor de doblaje.

¿Puedo crear una voz de personaje sin audio de referencia?

Sí. El diseño de voz construye una voz original solo a partir de una descripción escrita — edad, textura, actitud, acento —, así que los personajes que solo existen en tu guion o en tu arte conceptual pueden tener voz sin ninguna grabación de origen. Elegir de la biblioteca tampoco requiere audio tuyo.

¿Cuándo conviene clonar una voz en lugar de diseñarla?

Clona cuando la voz ya existe y tienes permiso para usarla: tu propia narración, un presentador habitual, un actor con quien trabajas. La clonación necesita una muestra breve autorizada (bastan 5 segundos de audio limpio: analizamos los primeros 60 segundos y conservamos los 30 mejores) y una confirmación de consentimiento. Para personajes que solo existen en el papel, diseñar una voz o elegirla de la biblioteca encaja mejor.

¿Cómo mantengo la voz de un personaje consistente entre episodios?

Guarda la voz como un activo con nombre y reutiliza ese mismo activo en cada aparición del personaje. La identidad queda fija mientras la dirección línea a línea cambia la interpretación: la Mara del episodio diez es la misma Mara, solo que más furiosa, más suave o más cansada según pida la escena.

¿Puede una sola voz interpretar varios personajes?

La dirección cambia la interpretación, no a la persona: una misma voz puede susurrar, gritar y dudar, pero conserva su timbre reconocible. Para personajes genuinamente distintos, dale a cada uno su propia voz; cuesta una descripción o una elección de biblioteca, y tus escenas dejan de depender de que el oyente no lo note.

¿Puedo manejar las voces de personaje desde la API?

Sí. Las voces que guardas en el navegador son direccionables por ID desde la Developer API: envías el texto, la voz y una instrucción en lenguaje natural, y recibes el audio interpretado. Eso cubre pipelines de diálogo de videojuegos, agentes que hablan en personaje y trabajos de narración por lotes.

¿Puedo usar las voces de personaje comercialmente y cuánto cuesta?

El audio generado en los planes de pago puede usarse comercialmente: en juegos, vídeos, audiolibros y pódcasts. Breeze Blue es gratis para empezar, con créditos gratuitos que puedes reclamar cada día, y los planes de pago añaden créditos mensuales y plazas de voz; el desglose completo está en la página de precios.