玛拉
声音库船长,年近六十——饱经风霜、不动如山,说话只下短促的命令。
从声音库挑选:低沉、带砂砾感的嗓音,语速缓慢而笃定。
“绑紧它。这场风暴别想再卷走一盏灯。”
低沉平稳,近乎低吼——这种场面她经历过一百次。
一段广播剧短场景在 Breeze Blue 上是这样完成的:每个角色从三种来源之一获得声音身份,每句台词都有自己的表演指令,最后逐句生成音频片段,编排并导出。
用一两句话勾勒每个角色——年龄、性情、说话的姿态。这份设定会变成你的声音选择和逐句指令。
从声音库挑一个身份、按角色描述设计一个、或克隆一个已授权的声音,并把每个声音保存为有名字的声音资产。
给每句台词附上一条自然语言指令——节奏、情绪、潜台词。声音保持身份不变,表演则跟随你的指令。
每句台词用对应角色的声音和指令生成,在 Studio 里按顺序编排片段,导出完成的场景音频。
船长,年近六十——饱经风霜、不动如山,说话只下短促的命令。
从声音库挑选:低沉、带砂砾感的嗓音,语速缓慢而笃定。
“绑紧它。这场风暴别想再卷走一盏灯。”
低沉平稳,近乎低吼——这种场面她经历过一百次。
甲板水手,16 岁——机灵、毛躁,一紧张语速就飞快。
只用一句描述设计而成:“少年般纤细的嗓音,一紧张就加速、发颤。”
“船长——绳子!已经开始磨断了!”
惊慌失措、上气不接下气,句尾音调越来越高。
讲故事的人——冷幽默、不紧不慢,始终站在故事之外一步。
从创作者本人的授权声音样本克隆而来,让节目保留主理人自己的声音。
“而这场风暴,自有它的打算。”
平静而带一点戏谑,在“打算”之前留一个小小的停顿。
每句台词都生成为独立片段——玛拉的低吼、皮普的惊慌、旁白干巴巴的旁注——各自带着角色的既定声音和逐句指令。在 Studio 里按顺序编排片段,对不满意的演绎随时重新生成,最后把整个场景导出为一个音频文件。
每套阵容都是混搭出来的。选哪种来源,取决于这个声音是已经存在、只存在于你的想象里,还是属于一位已授权给你的人。
当精选库里已经有合适的声音时,这是最快的路径。浏览一批真正有性格、且都可被指挥的声音,用你的台词试音,把最合适的那个存进阵容。
最适合:配角、旁白,以及今天就要出场景初稿的时候。
探索公开声音库 →当角色只存在于纸面上时,直接描述——“一个纤细的少年水手嗓音,一紧张就发颤”——就能听到一个为之量身打造的原创声音,不需要任何参考音频。
最适合:原创主角、NPC、奇幻生物,以及不该像任何人的声音。
了解 AI 音色设计的工作方式 →当声音属于你自己、或属于已明确同意的人——主播、合作的演员——用一段短授权样本(至少 5 秒干净音频即可,我们会分析前 60 秒并保留最合适的 30 秒)克隆它,然后像任何其他声音一样安排出演。
最适合:你自己的旁白声音、长期合作的主播、团队里的演员。
阅读音色克隆工作流 →大多数角色阵容的通病,是把“这个角色听起来像谁”和“这句台词该怎么说”混为一谈。Breeze Blue 有意把两者分开。
角色的音色——让人一听就认出的质地、音域和纹理——来自你挑选、设计或克隆的那个声音。你只定一次、保存下来,它就从第一季第一句到最后一句都保持稳定。
其余的一切——节奏、情绪、潜台词、克制——都是表演指令,在同一个声音之上用自然语言逐句书写。玛拉可以低吼命令、嘟囔疑虑、在悲恸中崩溃,却始终是同一个人。
这种分离是实测出来的,不是宣称出来的:在我们的 Voice Direction 基准(2026 年 8 月)中,Breeze TTS 2 在指令跟随上综合得分 4.25,同时说话人相似度保持在 0.67——表演在动,身份不动。
在 Breeze Blue 保存的声音属于你的账号,而不属于某一个项目。阵容搭一次,就能带去任何地方。
库里挑的、设计出的、授权克隆的声音,都会作为有名字的资产存进你的收藏——玛拉在每份剧本、每一集、每次改稿里都还是玛拉。
同一个已保存的声音,既能在单句文本转语音里用,也能在 Studio 的多声音剧本里用——补录一句和生成整场戏,用的是完全相同的身份。
每个已保存的声音都有一个可在 Developer API 中引用的 ID,你在浏览器里搭好的阵容,可以直接在流水线、游戏构建或批量渲染中开口说话。
复用是你主动做出的选择:每个项目、每句台词用哪个已保存的声音,都由你决定。Breeze Blue 不会背着你重新选角或改动你的收藏。
角色声音生成器为虚构角色创建一个独特的合成声音,并用它演绎角色的台词。在 Breeze Blue 上,这意味着两个决定:一个身份——从声音库挑选、用文字描述设计、或从授权样本克隆——以及一场逐句的表演,你用自然语言来导演,就像给配音演员说戏一样。
可以。音色设计只凭一段文字描述——年龄、质地、态度、口音——就能构建一个原创声音,让只存在于剧本或概念图里的角色获得声音,完全不需要源录音。从声音库挑选同样不需要你提供任何音频。
当这个声音已经真实存在、且你获得了使用许可时选择克隆——你自己的旁白、长期合作的主播、共事的演员。克隆需要一段短授权样本(至少 5 秒干净音频即可,我们会分析前 60 秒并保留最合适的 30 秒)和一次同意确认。而对只存在于纸面上的角色,设计声音或从库里挑选才是更合适的路径。
把声音保存为有名字的资产,然后在角色开口的每个地方复用同一个资产。身份保持固定,逐句指令只改变表演——第十集的玛拉还是同一个玛拉,只是随剧情需要更愤怒、更温柔或更疲惫。
指令改变的是表演,不是人——同一个声音可以耳语、嘶吼、迟疑,但它的音色始终可被辨认。真正不同的角色,最好各配各的声音;成本不过是一段描述或一次挑选,而你的场景也不用再指望听众听不出来。
能。你在浏览器里保存的声音都可以在 Developer API 中按 ID 调用:发送文本、声音和一条自然语言指令,就能拿回演绎好的音频。游戏对话流水线、以角色身份说话的智能体、批量旁白任务,都走这条路。
付费方案生成的音频可以商用——游戏、视频、有声书、播客都可以。Breeze Blue 免费起步,每天都能领取免费额度;付费方案提供更多月度额度和声音位。完整价格请见定价页面。