BytePlus Seed TTS 2.0
공급사 정가. 플랫폼 마진 없음, 종량제. 아래는 공식 정가입니다. 로그인한 고객은 /console/pricing 에서 워크스페이스 할인이 반영된 실제 가격을 볼 수 있습니다.
30초 만에 BytePlus Seed TTS 2.0 사용하기
OpenAI 호환. base_url만 바꾸면 SDK는 그대로. POST /v1/chat/completions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="seed-tts-2.0",
messages=[{"role": "user", "content": "Summarize this diff"}],
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "seed-tts-2.0",
messages: [{ role: "user", content: "Summarize this diff" }],
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "seed-tts-2.0",
"messages": [{"role": "user", "content": "Hello"}]
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "seed-tts-2.0",
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("seed-tts-2.0")
.addUserMessage("Summarize this diff")
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));스펙 및 제한
오디오
- 언어
- 영어, 중국어, 일본어, 독일어, 프랑스어, 멕시코 스페인어, 인도네시아어, 브라질 포르투갈어, 이탈리아어, 한국어
- 오디오 제한
-
- 단방향 스트리밍 HTTP, 단방향 또는 양방향 스트리밍 WebSocket, 온라인 SDK로 연동
- 샘플링 레이트는 단방향 스트리밍 및 비스트리밍 인터페이스에서 24K/16K/8K, 양방향 인터페이스에서 48K/24K/16K/8K
- 출력은 PCM, OGG_OPUS 또는 MP3(WAV도 허용되지만 스트리밍 시 헤더가 여러 개 반환됨)
- SSML 미지원
실시간
- 보이스
- TTS 2.0 음성은 *_uranus_bigtts 화자 ID를 사용하며 Voice List 페이지에 시나리오별(General, Entertainment, Education, Dubbing, AudioBook, RolePlay, CustomerService)로 정리되어 있습니다. 음성별 감정은 audio_params.emotion으로 지정하고 emotion_scale은 1에서 5까지(기본값 4), speech_rate와 loudness_rate는 [-50, 100], post_process.pitch는 [-12, 12] 범위입니다.
- 세션
- context_texts와 section_id는 TTS 2.0 전용입니다. 평이한 문장으로 된 지시가 속도, 감정, 음량, 스타일을 조절하고(목록의 첫 값만 적용되며 그 텍스트는 과금되지 않음), section_id는 앞선 합성을 최대 30회 또는 10분까지 이력 컨텍스트로 연결합니다.
모델
- 모달리티
- 텍스트 → 오디오
- 질의와 응답 텍스트를 함께 이해하는 Query-Response TTS로, TTS 1.0 대비 감정
- 어조
- 속도
- 음높이를 위한 텍스트 프롬프트, 문장 단위 감정 태그, 컨텍스트 이해가 추가되었습니다. X-Api-Resource-Id seed-tts-2.0으로 선택하며, enable_subtitle을 쓰면 TTS 2.0 음성에서 단어 및 음소 타임스탬프가 반환됩니다(중국어와 영어만). 응답 캐시는 선택 사항이며 1시간 동안 보관됩니다
BytePlus Seed TTS 2.0 소개
Seed TTS 2.0은 BytePlus에서 제공되는 ByteDance의 현행 텍스트 음성 변환 세대이며, 공식 개요는 이 모델을 쿼리-응답 메커니즘 위에 세웁니다: 모델이 사용자의 쿼리와 자신이 말하려는 응답 텍스트를 함께 읽으며, BytePlus는 이것이 문맥 이해를 넓히고 대화의 사람다움과 감정 표현을 날카롭게 다듬는다고 설명합니다.
- 대상 시나리오로는 AI 어시스턴트, AI 컴패니언, 콜센터, 영상 더빙을 꼽습니다.
- 1.0 라인 대비 2.0에만 있는 기능으로 세 가지가 제시됩니다: 감정, 어조, 말하기 속도, 음높이를 평이한 언어로 조정하는 텍스트 프롬프트, 문장 단위 감정 태그, 그리고 주변 대화를 제공하면 모델이 그 감정적 어조를 합성에 이어 가는 컨텍스트 이해입니다.
- 영어, 중국어, 일본어, 독일어, 프랑스어, 멕시코 스페인어, 인도네시아어, 브라질 포르투갈어, 이탈리아어, 한국어까지 열 개 언어를 커버하며, 단방향 스트리밍 HTTP, 단방향 또는 양방향 스트리밍 WebSocket, 온라인 SDK로 접근할 수 있습니다.
- 오디오는 기본 PCM 또는 OGG_OPUS나 MP3로 24 kHz 기본 샘플링 레이트에서 돌아오고, WAV는 스트리밍을 전혀 지원하지 않는다고 문서화되어 있습니다.
- 요청 인터페이스는 깊이가 있습니다: 공개된 목록에서 고르는 보이스 id, 각각 -50에서 100 범위인 말하기 속도와 음량, 일부 보이스만 받아들이는 1에서 5까지의 강도가 딸린 감정 설정, 중국어와 영어에 대한 선택적 단어·음소 타임스탬프, 그리고 반복되는 텍스트를 위한 한 시간짜리 합성 캐시가 있습니다.
- 실무적으로 두 가지를 유념해야 합니다: 입력 텍스트에서 SSML은 현재 지원되지 않으며, 감정 조정을 위해 전달한 컨텍스트는 과금되지 않습니다.
- 그 밖에는 공백과 구두점을 포함해 문자 단위로 과금됩니다.
- Synthorai는 나머지 음성 카탈로그와 함께 OpenAI 호환 /v1/audio/speech 엔드포인트로 이 모델을 서빙합니다.
자주 묻는 질문
BytePlus Seed TTS 2.0 API는 무료로 사용해 볼 수 있나요?
네, 신규 계정에는 10회의 체험 호출과 최대 $1의 무료 크레딧이 제공되며, 카드 등록이 필요 없습니다. 입력 토큰 $30/M 기준으로, 이 크레딧만으로도 BytePlus Seed TTS 2.0에 약 4K 토큰 규모의 요청을 대략 8회 보낼 수 있습니다.
BytePlus Seed TTS 2.0은 무엇에 가장 강한가요?
AI 어시스턴트, 콜센터, 영상 더빙을 겨냥, 평이한 언어 프롬프트로 감정·어조·말하기 속도·음높이 조정, 말할 응답 텍스트와 함께 사용자의 쿼리도 읽음. 전체 내용은 벤더의 공식 릴리스 노트를 정리한 소개 섹션을 참고하세요.
BytePlus Seed TTS 2.0의 가격은 얼마인가요?
Synthorai에서 BytePlus Seed TTS 2.0은 입력 토큰 100만 개당 $30, 출력 토큰 100만 개당 $0입니다. 공급사 정가 그대로이며 플랫폼 마진이 없습니다.
BytePlus Seed TTS 2.0은 프롬프트 캐싱을 지원하나요?
BytePlus Seed TTS 2.0은 현재 Synthorai에서 캐시 읽기 할인이 없습니다. 게이트웨이의 다른 모델에는 프롬프트 캐싱이 여전히 적용됩니다. 캐싱을 지원하는 대안은 가격표에서 확인하세요. 공급사별 캐싱 비교 →
BytePlus Seed TTS 2.0은 어떻게 이용하나요?
기존 OpenAI SDK의 base_url을 "https://synthorai.io/v1"로 지정하고 model="seed-tts-2.0"로 설정하면 끝입니다. API 키 하나로 게이트웨이의 모든 모델을 사용할 수 있습니다.