Pruna AI의 토킹 아바타 비디오 모델입니다 — 하나의 입력 이미지를 애니메이션화하여 제공된 텍스트(voice_script)나 업로드된 오디오 트랙을 말하게 하며, Gemini 계열의 선택형 프리셋 보이스, 언어, 시각적 연출 프롬프트를 지원합니다.
콘솔의 Playground에서 별도 코드 없이 이 모델을 즉시 테스트할 수 있어요
이 모델의 사용법을 Claude, ChatGPT 등에 복사
curl -X POST "https://api.core.today/v1/predictions" \
-H "Content-Type: application/json" \
-H "X-API-Key: cdt_your_api_key" \
-d '{
"model": "prunaai/p-video-avatar",
"input": {
"image": "https://example.com/presenter-photo.jpg",
"voice_script": "Welcome to our new product launch. Today we're excited to show you what we've been building.",
"voice": "Kore (Female)",
"voice_language": "English (US)",
"resolution": "1080p"
}
}'| 파라미터 | 타입 | 필수 | 기본값 | 설명 |
|---|---|---|---|---|
image | string | Yes | - | 입력 이미지(첫 프레임)입니다. jpg, jpeg, png, webp 형식을 지원합니다. |
resolution | string | No | 720p | 비디오 해상도입니다. 720p1080p |
audio | string | No | - | 아바타 발화를 구동할 업로드된 오디오(선택)입니다. 제공되면 voice_script 및 보이스 설정 대신 사용됩니다. |
voice | string | No | Zephyr (Female) | voice_script로부터 음성을 생성할 때 사용할 보이스입니다. Zephyr (Female)Puck (Male)Charon (Male)Kore (Female)Fenrir (Male)Leda (Female)Orus (Male)Aoede (Female)Callirrhoe (Female)Autonoe (Female)Enceladus (Male)Iapetus (Male)Umbriel (Male)Algenib (Male)Despina (Female)Erinome (Female)Laomedeia (Female)Achernar (Female)Algieba (Male)Schedar (Male)Gacrux (Female)Pulcherrima (Female)Achird (Male)Zubenelgenubi (Male)Vindemiatrix (Female)Sadachbia (Male)Sadaltager (Male)Sulafat (Female)Alnilam (Male)Rasalgethi (Male) |
voice_script | string | No | - | 아바타가 말할 정확한 대사입니다. 오디오 파일이 업로드되지 않은 경우 필수입니다. |
voice_prompt | string | No | Say the following. | voice_script를 말하는 방식(톤, 속도, 억양, 감정 등)에 대한 선택적 스타일 지시입니다. 실제로 발화되지는 않습니다. |
voice_language | string | No | English (US) | 생성될 음성의 언어/억양입니다. English (US)English (UK)SpanishFrenchGermanItalianPortuguese (Brazil)JapaneseKoreanHindi |
seed | integer | No | - | 랜덤 시드입니다. 재현 가능한 생성을 위해 설정하세요. |
video_prompt | string | No | The person is talking. | 발화 중 인물이 어떻게 보이거나 행동할지 묘사하는 선택적 시각 프롬프트입니다. |
negative_prompt | string | No | - | 비어 있으면 비활성화됩니다. 영상에 원하지 않는 요소(예: '자막, 텍스트, 흐림, 저화질, 프레임, 워터마크, 타이틀, 장면 전환')를 지정하세요. 여러 키워드를 동시에 사용하는 것을 권장합니다. |
strength_negative_prompt | number | No | 0.5 | 네거티브 프롬프트의 강도입니다. 최적값은 영상 길이에 따라 달라질 수 있습니다(실험적 기능). |
disable_safety_filter | boolean | No | true | 프롬프트와 입력 이미지에 대한 세이프티 필터를 비활성화합니다. 비활성화 시 생성 전 유해 콘텐츠 검사를 하지 않습니다. |
disable_prompt_upsampling | boolean | No | false | true로 설정하면 시각적 비디오 프롬프트의 자동 보강을 건너뛰고 video_prompt를 그대로 사용합니다. |
no_op | boolean | No | false | 헬스체크 모드입니다 — 실제 추론 없이 상태만 반환합니다. |
이 모델의 imageaudio 파라미터에 파일을 전달하는 방법은 3가지입니다.
POST /v1/predictions/upload에 파일을 직접 첨부합니다. 별도 업로드 과정이 필요 없습니다.
curl -X POST "https://api.core.today/v1/predictions/upload" \
-H "X-API-Key: cdt_your_api_key" \
-F "model=prunaai/p-video-avatar" \
-F 'input={"prompt":"your prompt here"}' \
-F "file:image=@your_file.png"공개 접근 가능한 URL을 직접 전달합니다. Storage API로 업로드한 파일의 file_url도 사용 가능합니다.
{
"model": "prunaai/p-video-avatar",
"input": {
"prompt": "your prompt here",
"image": "https://example.com/image.jpg"
}
}POST /v1/predictions 요청 시 사용되는 공통 파라미터입니다.
| 파라미터 | 타입 | 필수 | 기본값 | 설명 |
|---|---|---|---|---|
model | string | Yes | - | 모델 식별자 |
input | object | Yes | - | 위 테이블의 모델별 파라미터를 포함하는 객체 |
output_folder | string | No | - | 결과물 저장 폴더 경로 (최대 256자, '..' 사용 불가) |
webhook_url | string | No | - | 완료 시 호출할 Webhook URL |
is_public | boolean | No | false | true 시 결과물을 영구 공개 URL로도 제공 |
인물 사진을 애니메이션화하여 프리셋 보이스로 스크립트 메시지를 전달합니다.
curl -X POST "https://api.core.today/v1/predictions" \
-H "Content-Type: application/json" \
-H "X-API-Key: cdt_your_api_key" \
-d '{
"model": "prunaai/p-video-avatar",
"input": {
"image": "https://example.com/presenter-photo.jpg",
"voice_script": "Welcome to our new product launch. Today we're excited to show you what we've been building.",
"voice": "Kore (Female)",
"voice_language": "English (US)",
"resolution": "1080p"
}
}'텍스트-음성 변환 없이, 업로드한 오디오 녹음으로 아바타의 립싱크를 구동합니다.
curl -X POST "https://api.core.today/v1/predictions" \
-H "Content-Type: application/json" \
-H "X-API-Key: cdt_your_api_key" \
-d '{
"model": "prunaai/p-video-avatar",
"input": {
"image": "https://example.com/presenter-photo.jpg",
"audio": "https://example.com/voiceover.mp3",
"resolution": "720p"
}
}'