Skip to main content
SadTalker느림높음

SadTalker

사진 한 장과 오디오로 토킹헤드 영상을 만듭니다. 자연스러운 머리 움직임과 눈 깜빡임으로 얼굴을 애니메이션하며, GFPGAN 얼굴 향상 옵션을 제공합니다.

91 크레딧
실행당 (오디오 길이에 따라 처리 시간 증가)
사진 1장 + 오디오 → 토킹헤드 영상
자연스러운 머리 움직임과 눈 깜빡임
미세한 움직임의 still 모드
GFPGAN 얼굴 향상 옵션
포즈 스타일·표정 강도 제어

지금 바로 실행해보세요

콘솔의 Playground에서 별도 코드 없이 이 모델을 즉시 테스트할 수 있어요

로그인 후 사용해보기

AI 어시스턴트에서 사용하기

이 모델의 사용법을 Claude, ChatGPT 등에 복사

빠른 시작

curl -X POST "https://api.core.today/v1/predictions" \
  -H "Content-Type: application/json" \
  -H "X-API-Key: cdt_your_api_key" \
  -d '{
  "model": "cjwbw/sadtalker",
  "input": {
    "source_image": "https://example.com/portrait.jpg",
    "driven_audio": "https://example.com/narration.wav",
    "preprocess": "full",
    "still_mode": true,
    "use_enhancer": true
  }
}'

파라미터

파라미터타입필수기본값설명
source_imagestringYes-소스 얼굴 이미지 (png/jpg 또는 영상)
driven_audiostringYes-구동 오디오 (.wav 또는 .mp4)
use_enhancerbooleanNofalseGFPGAN 얼굴 향상 사용
pose_styleintegerNo0포즈 스타일
expression_scalenumberNo1클수록 표정 움직임이 강해짐
use_eyeblinkbooleanNotrue자연스러운 눈 깜빡임 추가
preprocessstringNocrop이미지 전처리 방식 (crop/resize/full/extcrop/extfull)
cropresizefullextcropextfull
size_of_imageintegerNo256얼굴 모델 해상도
256512
facerenderstringNofacevid2vid얼굴 렌더링 방식 선택
facevid2vidpirender
still_modebooleanNotrue머리 움직임 최소화 (preprocess 'full'과 함께 사용)

파일 입력 방법

이 모델의 source_imagedriven_audio 파라미터에 파일을 전달하는 방법은 3가지입니다.

추천

간편 업로드 (Multipart)

POST /v1/predictions/upload에 파일을 직접 첨부합니다. 별도 업로드 과정이 필요 없습니다.

curl -X POST "https://api.core.today/v1/predictions/upload" \
  -H "X-API-Key: cdt_your_api_key" \
  -F "model=cjwbw/sadtalker" \
  -F 'input={"prompt":"your prompt here"}' \
  -F "file:source_image=@your_file.png"

이미지 URL 전달

공개 접근 가능한 URL을 직접 전달합니다. Storage API로 업로드한 파일의 file_url도 사용 가능합니다.

{
  "model": "cjwbw/sadtalker",
  "input": {
    "prompt": "your prompt here",
    "source_image": "https://example.com/image.jpg"
  }
}
File Upload 문서에서 Presigned URL 방식 등 더 자세한 업로드 방법을 확인하세요.

공통 파라미터

POST /v1/predictions 요청 시 사용되는 공통 파라미터입니다.

파라미터타입필수기본값설명
modelstringYes-모델 식별자
inputobjectYes-위 테이블의 모델별 파라미터를 포함하는 객체
output_folderstringNo-결과물 저장 폴더 경로 (최대 256자, '..' 사용 불가)
webhook_urlstringNo-완료 시 호출할 Webhook URL
is_publicbooleanNofalsetrue 시 결과물을 영구 공개 URL로도 제공

예제

사진 아바타 나레이션

인물 사진이 보이스오버를 말하도록 애니메이션

curl -X POST "https://api.core.today/v1/predictions" \
  -H "Content-Type: application/json" \
  -H "X-API-Key: cdt_your_api_key" \
  -d '{
  "model": "cjwbw/sadtalker",
  "input": {
    "source_image": "https://example.com/portrait.jpg",
    "driven_audio": "https://example.com/narration.wav",
    "preprocess": "full",
    "still_mode": true,
    "use_enhancer": true
  }
}'

팁 & 모범 사례

1preprocess 'full' + still_mode 조합이 사진 전체를 유지하며 가장 자연스럽습니다
2use_enhancer를 켜면 얼굴이 선명해집니다 (처리 시간 증가)
3TTS 모델과 조합하면 사진→발표자 파이프라인이 됩니다
4반드시 당사자 동의가 있는 사진만 사용하세요

사용 사례

사진 한 장으로 만드는 가상 발표자
개인화 영상 메시지
교육용 아바타 나레이션
오래된 사진 애니메이션