最も表現力が高く 指示に応える音声合成モデル
演技を演出するために必要なすべて
すべての声とすべてのセリフを形づくる、完全なコントロール一式。
冷静で距離を置いた口調で始め、怒りを内に抑えてください。声を荒らげず、最後の二つの問いには鋭い皮肉を込めてください。
“ 「わかった、君の言う通りだ、私が悪かったよ。……これで満足かな? これ以上、私にどうしろって言うんだ?」 ”
普段の言葉で演出できる声
セリフをどう感じさせたいか、誰のように聞こえてほしいか、どんなテンポで進めたいか。私たちは自然な言葉による指示を受け取り、それに合わせて原稿を演じます。固定された一つの読み方で妥協するのではなく、監督が俳優を導くように話し方を形づくれます。
同じ声で、指示によって変わる演技を聴き比べられます。台詞の句読点や間は、それぞれの録音に合わせて表示しています。 指示文は録音時の英語の指示を日本語に訳したものです。
測定できる表現力
公開ベンチマーク Voice Direction Benchmark(700 件の演出課題、2026 年 8 月評価)で、Breeze TTS 2 は総合 Voice Direction Score 4.25 / 5 で首位に立ちました。同時に話者類似度は 0.67 を維持——声は別の声質に流れることなく、あなたの演出に従って演じます。
Voice Direction ベンチマークの全結果を見る- 4.25
- 総合 Voice Direction Score(1–5 スケール)
- 0.67
- 演出下でも保たれる話者類似度(0–1)
- 9
- 制御軸の数——アクセントや感情から意図まで
リアルタイム、低遅延設計
音声はミリ秒単位でストリーミングされ、ライブエージェントやインタラクティブメディアにも十分な速さです。ユーザーが話したその瞬間に応答する体験を、レンダリング待ちなしで作れます。
演技する声
どのセリフにも本物の感情の幅があります。ささやき、高まっていく興奮、ためらいの一拍。機械が読み上げたのではなく、演じられた言葉として届きます。
本当に個性のある音声ライブラリ
それぞれに個性を持つ厳選された声から選べます。自分の声をクローンしたり、新しく設計したりすることもできます。すべての声は完全に演出でき、すぐに演技を始められます。
ひとつの音声エンジンで、あらゆる制作に
どんなものを作っていても、BreezeBlue の声はそこで演じるために作られています。

オーディオブックとナレーション
原稿や台本を自然な響きのナレーションに変換します。章をまたいでも人物像とテンポが一貫し、制作時間はこれまでのごく一部で済みます。

動画のナレーション
動画、番組、アニメーションのナレーションを制作できます。トーンも感情も演出できるので、スタジオ収録なしでも読みが場面に合います。

ポッドキャスト
一貫した本格的なナレーションを一行ずつ演出しながら、ポッドキャストを制作できます。手作業の収録にかかる時間を減らせます。

会話エージェント
チャットボットや音声アシスタントに、リアルタイムで応答する自然で人間らしい声を与えます。本当に会話しているように感じられるやり取りが実現します。

ゲームとキャラクター
音声合成 API を通じて、ゲームキャラクターやオリジナルのキャストに声を与えます。文脈を踏まえた感情表現が、すべての場面にぴたりと合います。
Web アプリでも API でも利用可能
ひとつの指示、ふたつの実行方法
以下の指示と台詞を Creator に入力するか、API で送信して、自分の声での演技を試してみてください。
指示
冷静で距離を置いた口調で始め、怒りを内に抑えてください。声を荒らげず、最後の二つの問いには鋭い皮肉を込めてください。
テキスト
「わかった、君の言う通りだ、私が悪かったよ。……これで満足かな? これ以上、私にどうしろって言うんだ?」
Creator では指示欄と原稿欄にそれぞれ貼り付けます。API では同じ 2 つの文字列を 1 回の合成リクエストで送ると、音声がストリーミングで返ってきます。
次に進むページ
音声合成は声のワークフローの一段階にすぎません。これらのページが、入力する声づくりと、最終的に届ける作品づくりをカバーします。
よくある質問
BreezeBlue は他の音声合成ツールと何が違いますか?
私たちの音声モデルでは、「深夜のラジオパーソナリティのように、温かく、ゆったりと」といった指示を普段の言葉で書くだけで、声がその通りに演技を寄せていきます。あらかじめ用意された感情のリストから選ぶのではなく、声優に演出を伝えるのと同じ、自然な言葉による演出です。
特定のセリフの演技を細かく調整できますか?
はい。全体の指示に加えて、[sob]、[sigh]、[giggle] のような短い角かっこの合図をテキストの好きな場所に入れて、その一瞬だけを形づくれます。さらに Instruction Commitment で、声が指示をどこまで押し進めるかを、落ち着いた表現から大胆で表情豊かな表現まで設定できます。
音声合成にはどんな参照音声を使えますか?
プラットフォーム上のどの声も参照音声にできます。似たようなナレーションではなくそれぞれが個性を持つ厳選ライブラリから選ぶことも、短いサンプルから自分の声をクローンすることも、テキストのプロンプトから新しい声を設計することもできます。
BreezeBlue はどの言語に対応していますか?
Breeze TTS 2 Multilingual は 51 言語に対応しています。利用できる言語は選択したモデルによって決まり、BreezeBlue はそのモデルが現在公開している言語だけを表示します。
生成した音声を商用利用できますか?
BreezeBlue の有料プランで生成した音声は、動画や広告からゲーム、オーディオブックまで、商用プロジェクトで利用できます。
料金はいくらですか?無料プランはありますか?
はい。BreezeBlue は無料で始められ、すべてのユーザーが毎日無料のクレジットを受け取れます。有料プランではそこからさらに、月あたりのクレジット、音声スロット、生成速度が必要に応じて広がります。詳しい内訳は料金ページで確認できます。
どの音声フォーマットで書き出せますか?
音声合成と Studio で生成した音声は WAV で、音声ライブラリの声は MP3 でダウンロードできます。
AI の音声合成で、本当に感情のこもった声になりますか?
なります。しかもそれは約束ではなく、測定された結果です。公開ベンチマーク Voice Direction Benchmark(2026 年 8 月)で、Breeze TTS 2 は感情・意図・アクセントを含む 9 つの制御軸にわたり総合 4.25 / 5 を記録しました。実際の使い方は、こらえた悲しみ、高まっていく興奮、乾いた皮肉——欲しい感情をそのまま言葉で描写するだけ。声は既成の「うれしい」「悲しい」プリセットを当てはめるのではなく、その感情を演じます。
モデルが従ってくれる指示は、どう書けばよいですか?
監督の演出メモのつもりで書いてください。形容詞を積み上げるのではなく、感情、セリフの裏にある意図、テンポを名指しします。「ドラマチックにささやいて」よりも「聞かれるのを恐れているように、とても小さく緊張した声でささやいて」のほうがずっと確実です。このページの各サンプルは指示の全文をそのまま表示しているので、どれかを出発点に細部をひとつだけ変えて、何が変わるかを聴き比べられます。
API でも Web アプリと同じ指示コントロールが使えますか?
使えます。音声合成 API は Web の Creator と同じモデルを動かしているため、同じ自然言語の指示はどちらでも同じ演技を生みます。音声は API からストリーミングで返り、SDK なら数行でリクエストが完結します。このページに掲載したまったく同じ入力を使えば、2 つの経路が一致することも簡単に確かめられます。


