Le modèle de synthèse vocale le plus expressif et le plus dirigeable

Tout ce qu’il faut pour diriger une interprétation

Un jeu complet de contrôles pour façonner chaque voix et chaque réplique.

Commencez sur un ton froid et distant, en retenant la colère. Gardez une voix basse et donnez aux deux dernières questions un sarcasme mordant.

“ D'accord... tu as raison, c'est moi qui ai tort. Ça te suffit comme ça ? Qu'est-ce que tu veux que je fasse de plus ? ”

Des voix que vous dirigez en langage courant

Nous partons d’un prompt en langage naturel — ce que doit dégager une réplique, à qui elle doit ressembler, à quel rythme elle doit avancer — puis nous interprétons votre texte en conséquence. Vous façonnez le jeu comme un metteur en scène guide un acteur, au lieu de vous contenter d’une seule lecture figée.

Ces enregistrements présentent une même voix avec différentes consignes de jeu. Le texte conserve la ponctuation et les pauses de chaque extrait. Les consignes sont traduites des instructions anglaises utilisées pour les enregistrements.

Une expressivité qui se mesure

Sur le Voice Direction Benchmark ouvert (700 tâches de direction, évalué en août 2026), Breeze TTS 2 arrive en tête avec un Voice Direction Score global de 4.25 sur 5, tout en maintenant la similarité de locuteur à 0.67 — la voix suit votre direction sans dériver vers un autre timbre.

Explorer le benchmark Voice Direction complet
4.25
Voice Direction Score global, sur une échelle de 1 à 5
0.67
Similarité de locuteur maintenue sous direction (0–1)
9
Axes de contrôle, de l’accent et l’émotion à l’intention

Temps réel, conçu pour la faible latence

La voix arrive en flux en quelques millisecondes, assez vite pour des agents en direct et des médias interactifs. Vous concevez des expériences qui répondent à l’instant où l’utilisateur parle, sans attendre le moindre rendu.

Des voix qui jouent

Chaque réplique revient avec une vraie amplitude émotionnelle : un murmure, une excitation qui monte, un temps d’hésitation. Le résultat sonne joué, pas lu à voix haute par une machine.

Une bibliothèque de voix qui a du caractère

Choisissez parmi une sélection de voix, chacune avec sa propre personnalité — ou clonez et concevez la vôtre. Chaque voix est entièrement dirigeable, prête à jouer.

Un seul moteur vocal, tous les usages

Quel que soit ce que vous produisez, les voix BreezeBlue sont faites pour y jouer.

Interface de lecture de livre audio narrant un chapitre

Livres audio et narration

Transformez manuscrits et scénarios en narration au son naturel, avec un personnage et un rythme constants d’un chapitre à l’autre, en une fraction du temps.

Image vidéo accompagnée d’un sous-titre de voix off dirigée

Voix off vidéo

Produisez des voix off pour vidéos, séries et animations avec un ton et une émotion dirigeables, pour que la lecture colle à la scène sans passer par un studio.

Transcription d’une conversation de podcast entre deux animateurs

Podcasts

Créez des podcasts avec une narration professionnelle et constante, dirigeable réplique par réplique, et réduisez le temps passé à enregistrer.

Assistant de chat répondant avec une voix naturelle

Agents conversationnels

Donnez à vos chatbots et assistants virtuels une voix naturelle et humaine qui répond en temps réel, pour des échanges qui ressemblent vraiment à une conversation.

Personnages de jeu interprétés avec une intention émotionnelle

Jeux vidéo et personnages

Donnez une voix aux personnages de jeu et aux castings originaux via l’API de synthèse vocale, avec un jeu contextuel et émotionnellement juste pour chaque scène.

Disponible dans l’app web et via l’API

Une instruction, deux façons de l’exécuter

Utilisez cette consigne et ce texte dans le Creator, ou envoyez-les via l’API, pour créer votre propre interprétation.

Instruction

Commencez sur un ton froid et distant, en retenant la colère. Gardez une voix basse et donnez aux deux dernières questions un sarcasme mordant.

Texte

D'accord... tu as raison, c'est moi qui ai tort. Ça te suffit comme ça ? Qu'est-ce que tu veux que je fasse de plus ?

Dans le Creator, placez-les dans les champs instruction et texte. Via l’API, envoyez les deux mêmes chaînes dans une seule requête de synthèse et récupérez l’audio en streaming.

BreezeBlue Creator

Concevez, dirigez et générez des voix dans un seul outil de création dans le navigateur.

Espace de travail de synthèse vocale BreezeBlue Creator avec prompt, texte et lecteur

API et SDK de synthèse vocale

Intégrez la synthèse vocale BreezeBlue à votre produit via les API ou les SDK.

Exemple de code SDK Python diffusant de l’audio de synthèse vocale BreezeBlue

Questions fréquentes

En quoi BreezeBlue diffère-t-il des autres outils de synthèse vocale ?

Avec notre modèle vocal, vous écrivez votre prompt en langage courant — « parle comme un animateur de radio de fin de soirée, chaleureux et sans se presser » — et la voix ajuste son interprétation. C’est de la direction en langage naturel, comme si vous briefiez un comédien de doublage, et non une liste figée d’émotions prédéfinies.

Puis-je affiner le jeu de certaines répliques ?

Oui. Au-delà du prompt global, insérez de courts repères entre crochets comme [sob], [sigh] ou [giggle] n’importe où dans votre texte pour façonner un instant précis. Et le réglage Instruction Commitment vous laisse définir jusqu’où la voix pousse votre direction : du stable et posé à l’audacieux et expressif.

Quelle voix de référence puis-je utiliser pour la synthèse vocale ?

N’importe quelle voix de la plateforme peut servir de référence. Choisissez dans une bibliothèque sélectionnée — où chaque voix a sa propre personnalité plutôt qu’une narration interchangeable —, clonez la vôtre à partir d’un court échantillon ou concevez une nouvelle voix à partir d’un prompt écrit.

Quelles langues BreezeBlue prend-il en charge ?

Breeze TTS 2 Multilingual prend en charge 51 langues. Les langues disponibles dépendent du modèle choisi, et BreezeBlue n’affiche que celles que ce modèle expose actuellement.

Puis-je utiliser l’audio à des fins commerciales ?

L’audio généré avec les formules payantes de BreezeBlue peut être utilisé dans des projets commerciaux, des vidéos et publicités aux jeux et livres audio.

Combien ça coûte ? Existe-t-il une formule gratuite ?

Oui. BreezeBlue est gratuit pour démarrer, et chaque utilisateur peut réclamer des crédits gratuits chaque jour. Les formules payantes montent en puissance avec plus de crédits mensuels, plus d’emplacements de voix et une génération plus rapide à mesure que vos besoins grandissent. Voir le détail complet sur notre page de tarifs.

Quels formats audio puis-je exporter ?

L’audio généré dans Synthèse vocale et Studio se télécharge en WAV, tandis que les voix de la Bibliothèque de voix se téléchargent en MP3.

La synthèse vocale IA peut-elle vraiment transmettre de l’émotion ?

Oui — et c’est mesuré, pas seulement promis. Sur le Voice Direction Benchmark ouvert (août 2026), Breeze TTS 2 a obtenu un score global de 4.25 sur 5 à travers neuf axes de contrôle, dont l’émotion, l’intention et l’accent. En pratique, vous décrivez le sentiment recherché — un chagrin contenu, une excitation qui monte, un sarcasme sec — et la voix le joue, au lieu d’appliquer un préréglage figé « joyeux » ou « triste ».

Comment écrire une instruction vocale que le modèle suivra ?

Traitez-la comme une note de mise en scène : nommez l’émotion, l’intention derrière la réplique et le rythme, plutôt que d’empiler les adjectifs. « Dites-le en chuchotant, très bas et tendu, comme si vous aviez peur d’être entendu » fonctionne mieux que « chuchotez de façon dramatique ». Chaque extrait de cette page affiche son instruction complète mot pour mot — partez de l’une d’elles, changez un seul détail et écoutez précisément ce qui bouge.

L’API offre-t-elle le même contrôle par instruction que l’app web ?

Oui. L’API de synthèse vocale fait tourner le même modèle que le Creator web : la même instruction en langage naturel produit la même interprétation dirigée des deux côtés. L’audio revient en streaming via l’API, les SDK gèrent la requête en quelques lignes, et les entrées identiques de cette page permettent de vérifier facilement que les deux voies concordent.