Skip to main content
Core.Today
|
MiniMax보통높음

MiniMax Voice Cloning

10초~5분 분량의 오디오 샘플로 어떤 목소리든 복제합니다. MiniMax 음성 모델의 voice_id로 바로 사용할 수 있는 커스텀 voice_id와 복제 음성으로 합성한 미리듣기 클립을 반환합니다.

6980 크레딧
복제 1회당 (재사용 가능한 voice_id 반환)
10초 분량의 오디오만으로 음성 복제
복제된 voice_id를 MiniMax 음성 모델에서 바로 사용
결과에 미리듣기 오디오 클립 포함
잡음이 있는 샘플을 위한 노이즈 제거 옵션
볼륨 정규화 옵션

지금 바로 실행해보세요

콘솔의 Playground에서 별도 코드 없이 이 모델을 즉시 테스트할 수 있어요

로그인 후 사용해보기

AI 어시스턴트에서 사용하기

이 모델의 사용법을 Claude, ChatGPT 등에 복사

빠른 시작

curl -X POST "https://api.core.today/v1/predictions" \
  -H "Content-Type: application/json" \
  -H "X-API-Key: cdt_your_api_key" \
  -d '{
  "model": "minimax/voice-cloning",
  "input": {
    "voice_file": "https://example.com/narrator-sample.wav",
    "model": "speech-02-turbo",
    "accuracy": 0.7,
    "need_noise_reduction": false,
    "need_volume_normalization": false
  }
}'

파라미터

파라미터타입필수기본값설명
modelstringNospeech-02-turbo복제 음성을 학습시킬 텍스트-음성 변환 모델
speech-2.6-turbospeech-2.6-hdspeech-02-turbospeech-02-hd
accuracynumberNo0.7텍스트 검증 정확도 임계값 (0-1)
voice_filestringYes-복제할 음성 파일. MP3, M4A, WAV 형식, 10초~5분, 20MB 미만
need_noise_reductionbooleanNofalse음성 파일에 배경 소음이 있을 때 노이즈 제거 활성화
need_volume_normalizationbooleanNofalse볼륨 정규화 활성화

파일 입력 방법

이 모델의 voice_file 파라미터에 파일을 전달하는 방법은 3가지입니다.

추천

간편 업로드 (Multipart)

POST /v1/predictions/upload에 파일을 직접 첨부합니다. 별도 업로드 과정이 필요 없습니다.

curl -X POST "https://api.core.today/v1/predictions/upload" \
  -H "X-API-Key: cdt_your_api_key" \
  -F "model=minimax/voice-cloning" \
  -F 'input={"prompt":"your prompt here"}' \
  -F "file:voice_file=@your_file.png"

이미지 URL 전달

공개 접근 가능한 URL을 직접 전달합니다. Storage API로 업로드한 파일의 file_url도 사용 가능합니다.

{
  "model": "minimax/voice-cloning",
  "input": {
    "prompt": "your prompt here",
    "voice_file": "https://example.com/image.jpg"
  }
}
File Upload 문서에서 Presigned URL 방식 등 더 자세한 업로드 방법을 확인하세요.

공통 파라미터

POST /v1/predictions 요청 시 사용되는 공통 파라미터입니다.

파라미터타입필수기본값설명
modelstringYes-모델 식별자
inputobjectYes-위 테이블의 모델별 파라미터를 포함하는 객체
output_folderstringNo-결과물 저장 폴더 경로 (최대 256자, '..' 사용 불가)
webhook_urlstringNo-완료 시 호출할 Webhook URL
is_publicbooleanNofalsetrue 시 결과물을 영구 공개 URL로도 제공

예제

나레이터 음성 복제

깨끗한 스튜디오 녹음을 복제해 재사용 가능한 voice_id 획득

curl -X POST "https://api.core.today/v1/predictions" \
  -H "Content-Type: application/json" \
  -H "X-API-Key: cdt_your_api_key" \
  -d '{
  "model": "minimax/voice-cloning",
  "input": {
    "voice_file": "https://example.com/narrator-sample.wav",
    "model": "speech-02-turbo",
    "accuracy": 0.7,
    "need_noise_reduction": false,
    "need_volume_normalization": false
  }
}'

팁 & 모범 사례

1최고의 복제 품질을 위해 화자 1명의 깨끗한 30초~1분 샘플을 사용하세요
2반환된 voice_id를 MiniMax 음성 모델의 voice_id 파라미터로 전달하면 됩니다
3샘플에 배경 소음이 들릴 때만 need_noise_reduction을 활성화하세요
4실제로 합성에 사용할 모델을 선택하세요 — 복제는 모델별로 학습됩니다
5음성 복제는 반드시 당사자 동의 등 적법한 권한이 있는 음성만 사용하세요

사용 사례

브랜드 앰배서더·나레이터 음성 재사용
게임·애니메이션의 일관된 캐릭터 음성
개인화된 음성 어시스턴트
특정 목소리의 오디오북 나레이션
동일한 음성 아이덴티티로 현지화 더빙