캐릭터를 글로 묘사하면, 그 목소리가 들립니다.

보이스 디자인은 글로 쓴 설명을 재사용 가능한 오리지널 목소리로 바꿉니다. 녹음도, 참조 화자도 필요 없습니다. 캐릭터가 누구인지 쓰고, 결과를 들어 보고, 저장하면 Breeze Blue 전체에서 쓸 수 있습니다.

당신이 쓰는 설명

바다에 단련된 60대 여성 선장. 낮고 걸걸한 목소리, 느리고 단호한 말투, 옅은 아일랜드 억양, 거친 겉모습 아래의 따뜻함.

들리는 목소리

낮고 거친 결의 여성 목소리. 서두르지 않는 말투에 부드러운 아일랜드 억양—겉은 엄하지만 속은 다정합니다.

연기하는 대사

“그 밧줄 단단히 묶어라, 얘야—바다는 두 번은 용서하지 않아.”

당신이 쓰는 설명

어린이 만화에 나오는 과잉 흥분 로봇 조수. 금속성 울림이 있는 높은 목소리, 빠른 말투, 언제나 웃음이 터지기 직전.

들리는 목소리

밝고 통통 튀는 합성 목소리. 빠른 템포와 키득거리는 에너지를 지니면서도 아무리 빨라도 발음이 또렷합니다.

연기하는 대사

“새 작전! 예전 작전이랑 똑같은데, 제트팩이 훨씬 많아!”

당신이 쓰는 설명

차분한 명상 가이드, 중성적인 음색, 30대 중반. 부드럽고 숨결이 섞인 목소리, 마이크에 가까이, 거의 속삭임이지만 완벽하게 또렷함.

들리는 목소리

친밀하고 공기감 있는 목소리. 느긋한 템포와 따뜻한 중저음—조용하지만 명료함을 잃지 않습니다.

연기하는 대사

“그 생각이 지나가게 두세요, 넓은 하늘을 건너는 구름처럼.”

글로 쓴 설명에서 저장된 목소리까지, 세 단계

설명하고, 들어 보고, 저장하는 전체 과정이 하나의 워크스페이스에서 끝나며, 남긴 목소리는 영구적인 자산이 됩니다.

1

설명하기

캐릭터가 누구인지 자연어로 씁니다—나이, 질감, 말의 속도, 억양, 태도. 캐릭터 일러스트가 이미 있다면 이미지를 업로드해 거기서 시작할 수도 있습니다.

2

들어 보기

후보 목소리를 생성해 미리보기 대사를 연기하는 것을 들어 봅니다. 뭔가 아쉽다면 설명을 다듬으세요—더 낮게, 더 느리게, 덜 다듬어지게—머릿속의 목소리와 일치할 때까지 다시 생성합니다.

3

저장하기

마음에 드는 목소리를 보이스 목록에 저장합니다. 그 순간부터 재사용 가능한 자산입니다. 텍스트 음성 변환에서 선택하고, Studio 프로젝트에 캐스팅하고, API에서 ID로 호출하세요.

효과적인 설명을 쓰는 법

추상적인 성격 형용사보다 구체적이고 귀에 들리는 특징이 훨씬 잘 작동합니다. 좋은 설명은 다음 중 몇 가지를 직접 말합니다.

나이와 성별
“60대 여성”
질감
“걸걸한”, “숨결 섞인”, “금속성의”
말의 속도
“느리고 단호하게”, “빠르게 말함”
억양
“옅은 아일랜드 억양”
역할과 태도
“지친 야간 근무 형사”

한두 문장이면 충분합니다. 목소리가 어떻게 들리는지를 쓰고, 캐릭터가 이야기 속에서 무엇을 하는지는 생략하세요.

보이스 디자인이 정답인 순간

크리에이터들이 보이스 디자인을 찾는 다섯 가지 상황—각각에서 정확히 무슨 일이 일어나는지 설명합니다.

01

프리셋 목소리는 늘 한 끗이 아쉽다

머릿속에는 분명한 목소리가 있는데, 기성 선택지는 늘 조금씩 어긋납니다—톤은 맞는데 나이가 다르고, 억양은 맞는데 너무 다듬어져 있죠. 보이스 디자인은 그 마지막 한 끗을 메웁니다. 들리는 그 목소리를 그대로 글로 옮기고, 결과를 들어 보고, 딱 맞을 때까지 설명을 다듬으세요. 물론 ‘충분히 비슷함’으로 정말 충분하다면, 엄선된 목소리에서 시작하는 것이 여전히 더 빠른 길입니다.

보이스 라이브러리에서 출발점 고르기
02

캐릭터에게 참조할 화자가 없다

게임 NPC, 소설 속 인물, 버추얼 진행자—오리지널 캐릭터에게는 클론할 녹음이 애초에 존재하지 않습니다. 보이스 디자인은 원본 오디오가 전혀 필요 없습니다. 설명 자체가 원천입니다. 캐릭터 시트를 한두 문장으로 압축하면, 그 뒤에 실제 화자가 없는 오리지널 목소리를 얻게 됩니다.

크리에이터들이 캐릭터 목소리 진용을 짜는 법 보기
03

캐릭터는 그렸는데, 아직 목소리가 없다

때로는 그림이 목소리보다 먼저 완성됩니다. 보이스 디자인 워크스페이스에서는 캐릭터 이미지 자체에서 시작할 수 있습니다. 일러스트를 업로드해 보이는 모습에 어울리는 목소리를 생성하고, 이미지가 보여 주지 못하는 부분—말의 속도, 억양, 태도—은 글로 쓴 설명으로 조정하세요.

캐릭터 일러스트에서 목소리 시작하기
04

API는 요청당 최대 3개의 후보

웹에서는 후보를 하나씩 들어 보며 생성 사이에 설명을 다듬습니다. Voice Design API는 더 큰 단위로 움직입니다. 디자인 엔드포인트에 한 번 요청하면 같은 설명에서 최대 3개의 후보 목소리가 반환되므로, 파이프라인이 프로그램으로 후보군을 만들고 최종 선택은 사람이 하는 흐름을 구성할 수 있습니다.

Voice Design API 문서 읽기
POST /v1/text-to-voice/design
{
  "voice_description": "A weathered sea captain in her
    sixties, low and gravelly, with a faint Irish accent.",
  "text": "Tie that line down, lad.",
  "preview_count": 3
}
05

목소리는 마음에 든다—필요한 건 새로운 연기

그렇다면 디자인은 끝났습니다. 같은 목소리가 이 대사는 속삭이고 다음 대사는 외쳐야 한다면, 목소리는 그대로 두고 연기를 연출하세요. Breeze TTS 2는 대사 단위로 자연어 지시를 받습니다. 보이스 디자인은 ‘누가 말하는가’를 정하고, 보이스 디렉션은 ‘이 대사를 어떻게 연기하는가’를 정합니다.

텍스트 음성 변환에서 연기 연출하기

디자인, 라이브러리, 클론, 디렉션?

네 가지 도구, 네 가지 출발점. 지금 손에 있는 것으로 고르세요.

보이스 라이브러리

완성된 목소리에서 시작합니다. 스타일과 언어별로 엄선된 목소리를 둘러보고, 바로 들어 보고, 그대로 사용하세요—기성 목소리가 맞아떨어질 때 가장 빠른 길입니다.

보이스 라이브러리 살펴보기

보이스 클론

실제 녹음에서 시작합니다. 목소리가 이미 존재하고 화자의 허락을 받았다면, 클론은 짧은 승인된 샘플로 바로 그 목소리를 재현합니다.

5초 보이스 클론의 원리 알아보기

보이스 디자인

설명에서 시작합니다—바로 이 페이지입니다. 목소리가 머릿속이나 캐릭터 일러스트에만 존재할 때, 디자인은 녹음도 참조 화자도 없이 오리지널 목소리를 만들어 냅니다.

보이스 디렉션

이미 신뢰하는 목소리에서 시작합니다. 디렉션이 바꾸는 것은 대사를 전달하는 방식—감정, 템포, 연기 스타일—이며, 말하는 사람은 바뀌지 않습니다.

자연어 지시로 어떤 목소리든 연출하기

수식어 대신 증거

공개 Voice Design Benchmark는 1,000개의 캐릭터 보이스 디자인 과제로 주요 모델을 비교 평가합니다(2026년 8월 평가). Breeze TTS 2는 역할 적합도와 목소리 다양성에서 1위를 기록했습니다.

78.02

Role Fit(역할 적합도)

생성된 목소리가 설명된 역할과 얼마나 일치하는지를 100점 만점으로 정규화—평가 대상 모델 중 최고 점수.

708

고유 보이스 클러스터

전체 과제에서 산출된 고유 WavLM 화자 클러스터 수—이번 평가에서 가장 넓은 목소리 다양성.

98.5%

대사 통과율

생성된 클립 중 의도한 미리보기 대사를 또렷하게 말한 비율.

Voice Design Benchmark 전체 리더보드와 평가 방법 보기

Voice Design Benchmark · 2026년 8월 평가

브라우저에서 API까지

웹 앱에서 디자인

캐릭터를 설명하거나 일러스트를 업로드하고, 후보를 들어 본 뒤, 마음에 드는 목소리를 저장하세요. 저장된 목소리는 즉시 보이스 목록에 추가되어 텍스트 음성 변환에서 선택하고 Studio 프로젝트에서 다른 캐릭터와 함께 캐스팅할 수 있습니다.

Voice Design API로 확장

POST /v1/text-to-voice/design으로 후보를 생성하고, 남길 목소리는 POST /v1/text-to-voice로 저장하세요. 저장된 목소리는 기존 텍스트 음성 변환 연동이 쓰는 것과 같은 엔드포인트에서 ID로 참조할 수 있습니다.

API 디자인 요청당 최대 3개의 후보를 반환합니다. 웹 워크스페이스에서는 후보를 하나씩 들어 봅니다.

자주 묻는 질문

AI 보이스 디자인이란 무엇인가요?

보이스 디자인은 녹음 대신 글로 쓴 설명이나 캐릭터 이미지로 오리지널 목소리를 만드는 기능입니다. 화자의 나이, 질감, 말의 속도, 억양, 태도를 설명하고, 생성된 목소리를 들어 본 뒤, 텍스트 음성 변환·Studio 프로젝트·API에서 재사용할 수 있는 자산으로 저장합니다.

목소리 샘플이나 녹음이 필요한가요?

아니요. 보이스 디자인은 원본 오디오도 참조 화자도 필요 없습니다—입력은 설명뿐입니다. 만약 원하는 바로 그 목소리의 승인된 녹음을 갖고 있다면, 그 경우에는 보이스 클론이 더 알맞은 도구입니다.

디자인된 목소리는 누구의 목소리인가요?

누구의 것도 아닙니다. 디자인된 목소리는 당신의 설명에서 생성된 것으로, 실제 인물의 녹음이 아니며 특정 화자를 재현하도록 만들어지지도 않았습니다. 비슷한 설명은 비슷한 결과로 이어질 수 있으니, 디자인한 목소리는 유일무이함이 보장된 소리가 아니라 오리지널 창작물로 대해 주세요.

하나의 설명으로 여러 후보 목소리를 받을 수 있나요?

웹 앱에서는 후보를 하나씩 들어 보며 시도 사이에 설명을 다듬습니다. API를 통하면 디자인 엔드포인트에 대한 한 번의 요청으로 최대 3개의 후보를 받을 수 있어, 프로그램으로 후보군을 추린 뒤 사람이 최종 목소리를 고르는 파이프라인에 알맞습니다.

저장한 디자인 목소리는 어디에서 쓸 수 있나요?

Breeze Blue 어디서든 쓸 수 있습니다. 저장하면 목소리가 보이스 목록에 나타납니다. 텍스트 음성 변환에서 선택하고, 여러 캐릭터가 등장하는 Studio 프로젝트에 캐스팅하고, API 호출에서 ID로 참조하세요—같은 목소리, 같은 캐릭터를 모든 화면에서.

같은 디자인 목소리로 다른 감정을 표현할 수 있나요?

네—다만 그것은 보이스 디렉션이지 보이스 디자인이 아닙니다. 저장된 목소리는 그대로 두고 텍스트 음성 변환에서 대사별로 지시를 내리세요. 이 대사는 속삭이고, 다음 대사는 감정을 끌어올리고. 디자인은 누가 말하는지를 고정하고, 디렉션은 각 대사를 어떻게 연기하는지를 바꿉니다.

보이스 디자인 비용은 얼마인가요?

보이스 디자인은 Breeze Blue의 다른 기능과 같은 크레딧 잔액으로 작동하며, 무료 티어로 시작할 수 있습니다. 현재 요금제와 크레딧 환산은 가격 페이지에서 확인하세요.