BreezeBlue チームによるプロダクトの最新情報、技術解説、クリエイター向けワークフロー。
注目 · エンジニアリング
BreezeRT が段階別スケジューリング、段階的チャンク化、CUDA Graphs、再生期限で Breeze TTS 2 の初回音声遅延を削減する仕組み。
すべて:12 件の記事
ユーザーストーリー
『三体』三部作が残した「もしも」を、Zhuiyunjie は二次創作のオーディオストーリーへと紡ぎ直しました。Bilibili のフォロワーは 1 か月で 0 から 3 万人に増えています。
Nick が BreezeBlue を使って、AI 共同ホストに応答の速さと豊かな表現力を与え、視聴者とリアルタイムに交流しています。
ライブラリ、デザイン、それともクローン?
ガイド
音声プロジェクトは「誰に話してもらうか」から始まります。音声ライブラリの声を選ぶべきとき、オリジナルの声をデザインすべきとき、許諾を得た録音からクローンすべきとき、そして音声ディレクションだけで十分なときを解説します。
音声ライブラリで声を探して使う
思い描いた声を言葉で説明すれば、セマンティック検索が見つけてくれます。音声ページから読み取れること、12 のカテゴリの見て回り方、ライブラリの声を完成した音声に仕上げる方法を解説します。
音声デザインのプロンプトの書き方
書き始めは短い説明文で十分です。音声デザインのプロンプトを具体的にする 5 つの要素を学び、プロンプトと台本の 4 つの例を聴き比べ、適切なガイダンス設定を選びましょう。
音声ディレクションの書き方
音声ディレクションは、特定のパッセージをどう演じるかを声に伝えます。コンパクトな 5 つの要素の構成を学び、同じセリフを 5 通りに演出した例を聴き、適切なガイダンス設定を選びましょう。
音声ディレクションとオーディオタグを組み合わせる
音声ディレクションは演技を説明し、オーディオタグはため息、息をのむ音、笑いが起きる正確な位置を示します。2 つの組み合わせ方、タグを置く位置、機械的な読みを避けるコツを解説します。
リサーチ
Breeze TTS 2 は、Artificial Analysis の Provider Voice Arena でオープンウェイトのテキスト読み上げモデルとして第 1 位を獲得しました。ブラインドの人間による聴取テストに基づく Quality Elo スコアは 1215 で、2 位のオープンウェイトモデルに 90 ポイントの差をつけています。
プロダクト
あらゆる声をデザインし、すべての演技をディレクションします。しかもリアルタイムで。Breeze TTS 2 は、自然言語による音声デザイン、音声ディレクション、低レイテンシのストリーミング生成を、インタラクティブな体験のために作られたひとつのモデルに統合しています。
YouTube 向け AI ナレーションの実践ガイド。チャンネルに合う声の選び方、口調やテンポを普段の言葉で演出する方法、すべての投稿で同じ声を保つコツ、録り直しではなく再生成でセリフを修正する方法を解説します。
エンジニアリング
Breeze CLI は Breeze の音声生成をターミナルに持ち込みます。数秒で声を聞き、どのコマンドも Developer API のリクエストに変換でき、AI エージェントには音声とナレーション付き動画を作るための JSON ネイティブな手段を提供します。
Breeze TTS は BreezeBlue の指示追従型の音声モデルです。制御可能な AI 音声デザイン、音声ディレクション、表現力豊かな生成に対応します。