Skip to main content
Core.Today
|
Pruna AI보통높음

Pruna P-Video Avatar

Pruna AI의 토킹 아바타 비디오 모델입니다 — 하나의 입력 이미지를 애니메이션화하여 제공된 텍스트(voice_script)나 업로드된 오디오 트랙을 말하게 하며, Gemini 계열의 선택형 프리셋 보이스, 언어, 시각적 연출 프롬프트를 지원합니다.

870 크레딧
비디오당 정액 과금, 해상도별 차등
단일 입력 이미지로부터 토킹 아바타 애니메이션 생성
29종의 Gemini 계열 프리셋 보이스를 통한 텍스트-음성 변환, 또는 업로드된 오디오 트랙으로 발화 구동
10개 언어 보이스 선택과 voice_prompt를 통한 전달 방식 조정
네거티브 프롬프트 및 세이프티 필터/프롬프트 업샘플링 옵션 제공
초당 과금이 아닌, 해상도별 정액 비디오당 과금

지금 바로 실행해보세요

콘솔의 Playground에서 별도 코드 없이 이 모델을 즉시 테스트할 수 있어요

로그인 후 사용해보기

AI 어시스턴트에서 사용하기

이 모델의 사용법을 Claude, ChatGPT 등에 복사

빠른 시작

curl -X POST "https://api.core.today/v1/predictions" \
  -H "Content-Type: application/json" \
  -H "X-API-Key: cdt_your_api_key" \
  -d '{
  "model": "prunaai/p-video-avatar",
  "input": {
    "image": "https://example.com/presenter-photo.jpg",
    "voice_script": "Welcome to our new product launch. Today we're excited to show you what we've been building.",
    "voice": "Kore (Female)",
    "voice_language": "English (US)",
    "resolution": "1080p"
  }
}'

파라미터

파라미터타입필수기본값설명
imagestringYes-입력 이미지(첫 프레임)입니다. jpg, jpeg, png, webp 형식을 지원합니다.
resolutionstringNo720p비디오 해상도입니다.
720p1080p
audiostringNo-아바타 발화를 구동할 업로드된 오디오(선택)입니다. 제공되면 voice_script 및 보이스 설정 대신 사용됩니다.
voicestringNoZephyr (Female)voice_script로부터 음성을 생성할 때 사용할 보이스입니다.
Zephyr (Female)Puck (Male)Charon (Male)Kore (Female)Fenrir (Male)Leda (Female)Orus (Male)Aoede (Female)Callirrhoe (Female)Autonoe (Female)Enceladus (Male)Iapetus (Male)Umbriel (Male)Algenib (Male)Despina (Female)Erinome (Female)Laomedeia (Female)Achernar (Female)Algieba (Male)Schedar (Male)Gacrux (Female)Pulcherrima (Female)Achird (Male)Zubenelgenubi (Male)Vindemiatrix (Female)Sadachbia (Male)Sadaltager (Male)Sulafat (Female)Alnilam (Male)Rasalgethi (Male)
voice_scriptstringNo-아바타가 말할 정확한 대사입니다. 오디오 파일이 업로드되지 않은 경우 필수입니다.
voice_promptstringNoSay the following.voice_script를 말하는 방식(톤, 속도, 억양, 감정 등)에 대한 선택적 스타일 지시입니다. 실제로 발화되지는 않습니다.
voice_languagestringNoEnglish (US)생성될 음성의 언어/억양입니다.
English (US)English (UK)SpanishFrenchGermanItalianPortuguese (Brazil)JapaneseKoreanHindi
seedintegerNo-랜덤 시드입니다. 재현 가능한 생성을 위해 설정하세요.
video_promptstringNoThe person is talking.발화 중 인물이 어떻게 보이거나 행동할지 묘사하는 선택적 시각 프롬프트입니다.
negative_promptstringNo-비어 있으면 비활성화됩니다. 영상에 원하지 않는 요소(예: '자막, 텍스트, 흐림, 저화질, 프레임, 워터마크, 타이틀, 장면 전환')를 지정하세요. 여러 키워드를 동시에 사용하는 것을 권장합니다.
strength_negative_promptnumberNo0.5네거티브 프롬프트의 강도입니다. 최적값은 영상 길이에 따라 달라질 수 있습니다(실험적 기능).
disable_safety_filterbooleanNotrue프롬프트와 입력 이미지에 대한 세이프티 필터를 비활성화합니다. 비활성화 시 생성 전 유해 콘텐츠 검사를 하지 않습니다.
disable_prompt_upsamplingbooleanNofalsetrue로 설정하면 시각적 비디오 프롬프트의 자동 보강을 건너뛰고 video_prompt를 그대로 사용합니다.
no_opbooleanNofalse헬스체크 모드입니다 — 실제 추론 없이 상태만 반환합니다.

파일 입력 방법

이 모델의 imageaudio 파라미터에 파일을 전달하는 방법은 3가지입니다.

추천

간편 업로드 (Multipart)

POST /v1/predictions/upload에 파일을 직접 첨부합니다. 별도 업로드 과정이 필요 없습니다.

curl -X POST "https://api.core.today/v1/predictions/upload" \
  -H "X-API-Key: cdt_your_api_key" \
  -F "model=prunaai/p-video-avatar" \
  -F 'input={"prompt":"your prompt here"}' \
  -F "file:image=@your_file.png"

이미지 URL 전달

공개 접근 가능한 URL을 직접 전달합니다. Storage API로 업로드한 파일의 file_url도 사용 가능합니다.

{
  "model": "prunaai/p-video-avatar",
  "input": {
    "prompt": "your prompt here",
    "image": "https://example.com/image.jpg"
  }
}
File Upload 문서에서 Presigned URL 방식 등 더 자세한 업로드 방법을 확인하세요.

공통 파라미터

POST /v1/predictions 요청 시 사용되는 공통 파라미터입니다.

파라미터타입필수기본값설명
modelstringYes-모델 식별자
inputobjectYes-위 테이블의 모델별 파라미터를 포함하는 객체
output_folderstringNo-결과물 저장 폴더 경로 (최대 256자, '..' 사용 불가)
webhook_urlstringNo-완료 시 호출할 Webhook URL
is_publicbooleanNofalsetrue 시 결과물을 영구 공개 URL로도 제공

예제

스크립트를 읽는 AI 발표자

인물 사진을 애니메이션화하여 프리셋 보이스로 스크립트 메시지를 전달합니다.

curl -X POST "https://api.core.today/v1/predictions" \
  -H "Content-Type: application/json" \
  -H "X-API-Key: cdt_your_api_key" \
  -d '{
  "model": "prunaai/p-video-avatar",
  "input": {
    "image": "https://example.com/presenter-photo.jpg",
    "voice_script": "Welcome to our new product launch. Today we're excited to show you what we've been building.",
    "voice": "Kore (Female)",
    "voice_language": "English (US)",
    "resolution": "1080p"
  }
}'

기존 보이스오버로 구동하는 아바타

텍스트-음성 변환 없이, 업로드한 오디오 녹음으로 아바타의 립싱크를 구동합니다.

curl -X POST "https://api.core.today/v1/predictions" \
  -H "Content-Type: application/json" \
  -H "X-API-Key: cdt_your_api_key" \
  -d '{
  "model": "prunaai/p-video-avatar",
  "input": {
    "image": "https://example.com/presenter-photo.jpg",
    "audio": "https://example.com/voiceover.mp3",
    "resolution": "720p"
  }
}'

팁 & 모범 사례

1이미 보이스오버 녹음이 있다면 voice_script 대신 audio로 업로드하세요 — audio가 우선 적용되어 텍스트-음성 변환을 건너뜁니다.
2voice_script는 audio 파일이 제공되지 않은 경우에만 필수입니다. 오디오로 아바타를 구동할 때는 비워두세요.
3해상도별 정액 비디오당 과금이므로 대사가 길어져도 추가 비용이 발생하지 않습니다 — 해상도 티어만 비용에 영향을 줍니다.
4voice_prompt를 사용하면 voice_script의 실제 대사 내용은 바꾸지 않고 톤·속도·감정 등 전달 방식만 조정할 수 있습니다.

사용 사례

제품 런칭용 AI 스포크스퍼슨/발표자 영상
스크립트 기반 자동 설명/온보딩 영상
동일한 소스 이미지를 활용한 다국어 마케팅 아바타
오디오 입력을 통해 기존 보이스오버 녹음을 토킹 아바타 영상으로 전환