Décrivez le personnage. Écoutez sa voix.

Le design de voix transforme une description écrite en une voix originale et réutilisable. Pas d’enregistrement, pas de voix de référence : écrivez qui est le personnage, écoutez le résultat et enregistrez-le pour l’utiliser dans tout Breeze Blue.

Vous décrivez

Une capitaine de navire burinée, la soixantaine. Voix grave et éraillée, débit lent et posé, un léger accent irlandais, de la chaleur sous la rudesse.

Vous entendez

Une voix féminine grave et rugueuse, au débit tranquille et au doux accent irlandais — sévère en surface, bienveillante en dessous.

La réplique jouée

« Amarre ce cordage, petit — la mer ne pardonne pas deux fois. »

Vous décrivez

Un robot acolyte surexcité de dessin animé pour enfants. Voix aiguë à la résonance métallique, débit rapide, toujours au bord du fou rire.

Vous entendez

Une voix synthétique vive et bondissante, au rythme rapide et à l’énergie rieuse, qui reste parfaitement nette même à toute vitesse.

La réplique jouée

« Nouveau plan ! Comme l’ancien, mais avec beaucoup plus de jetpacks ! »

Vous décrivez

Un guide de méditation posé, androgyne, environ trente-cinq ans. Doux et feutré, tout près du micro, presque un murmure mais parfaitement clair.

Vous entendez

Une voix intime et aérienne, au rythme doux et aux bas-médiums chaleureux — silencieuse sans jamais perdre en intelligibilité.

La réplique jouée

« Laissez passer la pensée, comme un nuage qui traverse un grand ciel. »

De la description écrite à la voix enregistrée en trois étapes

Toute la boucle — décrire, écouter, enregistrer — se déroule dans un même espace de travail, et la voix retenue devient un actif permanent.

1

Décrivez

Écrivez qui est le personnage en langage naturel : âge, texture, débit, accent, attitude. Si le personnage est déjà dessiné, importez l’illustration et partez de l’image.

2

Écoutez

Générez une voix candidate et écoutez-la jouer une réplique d’essai. Pas tout à fait ça ? Ajustez la description — plus grave, plus lente, moins lisse — et régénérez jusqu’à retrouver la voix que vous avez en tête.

3

Enregistrez

Enregistrez la voix retenue dans votre liste. Dès cet instant, c’est un actif réutilisable : sélectionnez-la en synthèse vocale, distribuez-la dans vos projets Studio et appelez-la par ID via l’API.

Écrire une description qui fonctionne

Les traits concrets et audibles l’emportent sur les adjectifs abstraits de personnalité. Les meilleures descriptions énoncent directement plusieurs de ces éléments :

Âge et genre
« une femme d’une soixantaine d’années »
Texture
« éraillée », « feutrée », « métallique »
Débit
« lent et posé », « parle vite »
Accent
« un léger accent irlandais »
Rôle et attitude
« un détective épuisé de l’équipe de nuit »

Une ou deux phrases suffisent. Décrivez le son de la voix ; laissez de côté ce que le personnage fait dans l’histoire.

Quand le design de voix est le bon outil

Cinq situations que les créateurs apportent au design de voix — et ce qui se passe exactement dans chacune.

01

La voix préconçue est toujours presque juste

Vous entendez la voix dans votre tête, et chaque option toute faite tombe légèrement à côté : le bon ton mais le mauvais âge, le bon accent mais trop lisse. Le design de voix comble ce dernier écart : écrivez exactement la voix que vous entendez, écoutez le résultat et affinez la description jusqu’au déclic. Et quand « presque juste » suffit vraiment, partir d’une voix sélectionnée reste la voie la plus rapide.

Choisir un point de départ dans la bibliothèque de voix
02

Le personnage n’a pas de voix de référence

PNJ de jeux, personnages de fiction, présentateurs virtuels : les personnages originaux n’arrivent pas avec un enregistrement à cloner. Le design de voix n’a besoin d’aucun audio source : la description est la source. Condensez la fiche du personnage en une ou deux phrases, et le résultat est une voix originale sans aucun locuteur humain derrière.

Voir comment les créateurs construisent des distributions complètes
03

Le personnage est dessiné, mais pas encore entendu

Parfois, l’illustration arrive avant la voix. Dans l’espace de design de voix, vous pouvez partir de l’image même du personnage : importez l’illustration et générez une voix accordée à ce que vous voyez, en ajoutant une description écrite pour piloter ce que l’image ne montre pas — débit, accent, attitude.

Créer une voix à partir de l’illustration d’un personnage
04

Jusqu’à 3 candidates par requête API

Sur le web, vous écoutez une candidate à la fois et affinez la description entre deux essais. La Voice Design API voit plus large : une seule requête à l’endpoint de design renvoie jusqu’à 3 voix candidates à partir de la même description — un pipeline peut ainsi générer une présélection de manière programmatique avant qu’une personne ne tranche.

Lire la documentation de la Voice Design API
POST /v1/text-to-voice/design
{
  "voice_description": "A weathered sea captain in her
    sixties, low and gravelly, with a faint Irish accent.",
  "text": "Tie that line down, lad.",
  "preview_count": 3
}
05

Vous adorez la voix — il vous faut de nouvelles interprétations

Alors le design est terminé. Quand la même voix doit murmurer une réplique et crier la suivante, gardez la voix et dirigez le jeu : Breeze TTS 2 accepte des instructions en langage naturel, réplique par réplique. Le design de voix décide qui parle ; la direction de voix décide comment chaque réplique est jouée.

Diriger des interprétations en synthèse vocale

Design, bibliothèque, clonage ou direction ?

Quatre outils, quatre points de départ. Choisissez selon ce que vous avez déjà.

Bibliothèque de voix

Partez d’une voix aboutie. Parcourez des voix sélectionnées par style et par langue, écoutez-les instantanément et utilisez-les telles quelles — la voie la plus rapide quand une voix prête à l’emploi convient.

Explorer la bibliothèque de voix

Clonage de voix

Partez d’un enregistrement réel. Quand la voix existe déjà et que vous avez l’autorisation du locuteur, le clonage reproduit cette voix précise à partir d’un court échantillon autorisé.

Comment fonctionne le clonage de voix en 5 secondes

Design de voix

Partez d’une description — c’est cette page. Quand la voix n’existe que dans votre tête ou dans l’illustration du personnage, le design crée une voix originale sans enregistrement ni voix de référence.

Direction de voix

Partez d’une voix qui vous convient déjà. La direction change la façon dont une réplique est livrée — émotion, rythme, style — sans changer qui parle.

Diriger n’importe quelle voix avec des instructions en langage naturel

Des preuves, pas des adjectifs

Le Voice Design Benchmark ouvert évalue 1,000 tâches de design de voix de personnages sur les principaux modèles (évaluation d’août 2026). Breeze TTS 2 se classe premier en adéquation au rôle et en diversité de voix :

78.02

Role Fit (adéquation au rôle)

À quel point les voix générées correspondent au rôle décrit, normalisé sur 100 — le meilleur score parmi les modèles évalués.

708

Clusters de voix distincts

Clusters de locuteurs WavLM distincts sur l’ensemble des tâches — la plus grande diversité de voix de l’évaluation.

98.5%

Transcription validée

Part des clips générés qui prononcent clairement leur réplique d’essai.

Voir le classement complet et la méthodologie du Voice Design Benchmark

Voice Design Benchmark · évalué en août 2026

Du navigateur à l’API

Créez dans l’application web

Décrivez le personnage — ou importez son illustration —, écoutez les candidates et enregistrez la retenue. Les voix enregistrées rejoignent immédiatement votre liste, prêtes pour la synthèse vocale et pour la distribution dans vos projets Studio.

Passez à l’échelle avec la Voice Design API

Générez des candidates avec POST /v1/text-to-voice/design, puis conservez la retenue avec POST /v1/text-to-voice. Les voix enregistrées s’adressent par ID via les mêmes endpoints que votre intégration de synthèse vocale utilise déjà.

Jusqu’à 3 candidates par requête de design via l’API ; l’espace web fait écouter une candidate à la fois.

Questions fréquentes

Qu’est-ce que le design de voix par IA ?

Le design de voix crée une voix originale à partir d’une description écrite ou de l’image d’un personnage, plutôt que d’un enregistrement. Vous décrivez le locuteur — âge, texture, débit, accent, attitude —, écoutez la voix générée et l’enregistrez comme actif réutilisable pour la synthèse vocale, les projets Studio et l’API.

Ai-je besoin d’un échantillon ou d’un enregistrement ?

Non. Le design de voix ne demande ni audio source ni voix de référence — la description constitue toute l’entrée. Si vous disposez d’un enregistrement autorisé de la voix exacte que vous visez, le clonage de voix est alors l’outil adapté.

À qui appartient une voix designée ?

À personne. Une voix designée est générée à partir de votre description ; ce n’est pas l’enregistrement d’une personne et elle n’est pas conçue pour reproduire un locuteur précis. Des descriptions proches peuvent donner des résultats proches : considérez une voix designée comme une création originale, pas comme un son garanti unique en son genre.

Puis-je obtenir plusieurs voix candidates d’une même description ?

Dans l’application web, vous écoutez une candidate à la fois et affinez la description entre deux essais. Via l’API, une seule requête à l’endpoint de design peut renvoyer jusqu’à 3 candidates — idéal pour les flux qui présélectionnent de façon programmatique avant qu’une personne ne choisisse la voix finale.

Où puis-je utiliser une voix designée une fois enregistrée ?

Partout dans Breeze Blue. Une fois enregistrée, la voix apparaît dans votre liste : sélectionnez-la en synthèse vocale, distribuez-la dans des projets Studio à plusieurs personnages et référencez son ID dans vos appels API — la même voix, le même personnage, sur toutes les surfaces.

Une même voix designée peut-elle exprimer différentes émotions ?

Oui — mais c’est de la direction de voix, pas du design. Gardez la voix enregistrée et donnez des instructions réplique par réplique en synthèse vocale : murmurez cette ligne, faites monter l’émotion sur la suivante. Le design fixe qui parle ; la direction change la façon de jouer chaque réplique.

Combien coûte le design de voix ?

Le design de voix puise dans le même solde de crédits que le reste de Breeze Blue, et vous pouvez commencer avec l’offre gratuite. Consultez la page des tarifs pour les formules actuelles et la conversion des crédits en génération.