Skip to main content
Coqui보통표준

XTTS-v2

Coqui XTTS-v2 다국어 음성 복제 TTS입니다. 짧은 오디오 샘플 하나로 음성을 복제해 16개 언어로 말하게 할 수 있는, 가장 널리 쓰이는 오픈소스 음성 복제 모델 중 하나입니다.

26 크레딧
생성당
짧은 오디오 샘플 하나로 음성 복제
한국어 포함 16개 언어 지원
언어 교차 복제 (복제 음성으로 어떤 언어든 발화)
마이크 녹음용 노이즈 제거 옵션
검증된 오픈소스 모델 (700만+ 실행)

지금 바로 실행해보세요

콘솔의 Playground에서 별도 코드 없이 이 모델을 즉시 테스트할 수 있어요

로그인 후 사용해보기

AI 어시스턴트에서 사용하기

이 모델의 사용법을 Claude, ChatGPT 등에 복사

빠른 시작

curl -X POST "https://api.core.today/v1/predictions" \
  -H "Content-Type: application/json" \
  -H "X-API-Key: cdt_your_api_key" \
  -d '{
  "model": "lucataco/xtts-v2",
  "input": {
    "speaker": "https://example.com/voice-sample.wav",
    "text": "안녕하세요, 이것은 제 목소리로 만든 한국어 음성입니다.",
    "language": "ko",
    "cleanup_voice": true
  }
}'

파라미터

파라미터타입필수기본값설명
textstringNoHi there, I'm your new voice clone. Try your best to upload quality audio복제 음성으로 합성할 텍스트
speakerstringYes-복제할 화자 오디오 (wav, mp3, m4a, ogg, flv)
languagestringNoen합성 음성의 출력 언어
enesfrdeitptpltrrunlcsarzhhukohi
cleanup_voicebooleanNofalse화자 오디오에 노이즈 제거 적용 (마이크 녹음에 권장)

파일 입력 방법

이 모델의 speaker 파라미터에 파일을 전달하는 방법은 3가지입니다.

추천

간편 업로드 (Multipart)

POST /v1/predictions/upload에 파일을 직접 첨부합니다. 별도 업로드 과정이 필요 없습니다.

curl -X POST "https://api.core.today/v1/predictions/upload" \
  -H "X-API-Key: cdt_your_api_key" \
  -F "model=lucataco/xtts-v2" \
  -F 'input={"prompt":"your prompt here"}' \
  -F "file:speaker=@your_file.png"

이미지 URL 전달

공개 접근 가능한 URL을 직접 전달합니다. Storage API로 업로드한 파일의 file_url도 사용 가능합니다.

{
  "model": "lucataco/xtts-v2",
  "input": {
    "prompt": "your prompt here",
    "speaker": "https://example.com/image.jpg"
  }
}
File Upload 문서에서 Presigned URL 방식 등 더 자세한 업로드 방법을 확인하세요.

공통 파라미터

POST /v1/predictions 요청 시 사용되는 공통 파라미터입니다.

파라미터타입필수기본값설명
modelstringYes-모델 식별자
inputobjectYes-위 테이블의 모델별 파라미터를 포함하는 객체
output_folderstringNo-결과물 저장 폴더 경로 (최대 256자, '..' 사용 불가)
webhook_urlstringNo-완료 시 호출할 Webhook URL
is_publicbooleanNofalsetrue 시 결과물을 영구 공개 URL로도 제공

예제

복제 후 한국어 발화

영어 화자를 복제해 한국어로 말하게 하기

curl -X POST "https://api.core.today/v1/predictions" \
  -H "Content-Type: application/json" \
  -H "X-API-Key: cdt_your_api_key" \
  -d '{
  "model": "lucataco/xtts-v2",
  "input": {
    "speaker": "https://example.com/voice-sample.wav",
    "text": "안녕하세요, 이것은 제 목소리로 만든 한국어 음성입니다.",
    "language": "ko",
    "cleanup_voice": true
  }
}'

팁 & 모범 사례

1최고의 복제 품질을 위해 10-30초의 깨끗한 화자 샘플을 사용하세요
2휴대폰·노트북 마이크 녹음이면 cleanup_voice를 켜세요
3샘플 언어와 무관하게 복제 음성으로 16개 언어 모두 발화 가능합니다
4생성당 25크레딧 고정 과금이며, 텍스트가 길수록 처리 시간이 늘어납니다
5음성 복제는 반드시 사용 권한이 있는 목소리만 사용하세요

사용 사례

빠른 음성 복제 실험
개인화 음성 메시지
다국어 더빙 프로토타입
목소리 보존 프로젝트
캐릭터 음성 생성