Skip to main content
Core.Today
|
Google빠름높음

Gemini 3.8 Flash TTS

Fal.AI를 통해 제공되는 Google Gemini 3.8 Flash TTS입니다. 30종의 프리셋 음성으로 단일 화자 내레이션을 생성하며, 전달 방식은 별도의 스타일 지시문으로 지정하고 <laugh>, <sigh> 같은 인라인 발성 이벤트를 지원합니다. WAV 오디오를 반환합니다.

105 크레딧
발화 텍스트 1000자당 (0.104625 크레딧/자, 스타일 지시문은 과금 제외)
30종의 Gemini 프리셋 음성
발화 텍스트와 분리된 스타일 지시문 — 과금 대상 아님
<laugh>, <sigh> 같은 인라인 발성 이벤트
실제로 발화되는 글자만 과금

지금 바로 실행해보세요

콘솔의 Playground에서 별도 코드 없이 이 모델을 즉시 테스트할 수 있어요

로그인 후 사용해보기

AI 어시스턴트에서 사용하기

이 모델의 사용법을 Claude, ChatGPT 등에 복사

빠른 시작

curl -X POST "https://api.core.today/v1/predictions" \
  -H "Content-Type: application/json" \
  -H "X-API-Key: cdt_your_api_key" \
  -d '{
  "model": "google/gemini-3.8-flash-tts",
  "input": {
    "prompt": "Have a wonderful day!",
    "style_instructions": "cheerful and friendly",
    "voice": "Kore"
  }
}'

파라미터

파라미터타입필수기본값설명
promptstringYes-그대로 읽을 텍스트입니다(글자 단위 과금). 전달 방식은 style_instructions에 적고, <laugh>, <sigh> 같은 인라인 발성 이벤트를 쓸 수 있습니다. 전체 입력은 8,192토큰으로 제한됩니다.
style_instructionsstringNo-발화 텍스트와 분리된 전달 스타일입니다(예: "밝고 친근하게"). 과금되지 않습니다.
voicestringNoKore단일 화자 음성에 쓸 프리셋 음성입니다.
AchernarAchirdAlgenibAlgiebaAlnilamAoedeAutonoeCallirrhoeCharonDespinaEnceladusErinomeFenrirGacruxIapetusKoreLaomedeiaLedaOrusPulcherrimaPuckRasalgethiSadachbiaSadaltagerSchedarSulafatUmbrielVindemiatrixZephyrZubenelgenubi

공통 파라미터

POST /v1/predictions 요청 시 사용되는 공통 파라미터입니다.

파라미터타입필수기본값설명
modelstringYes-모델 식별자
inputobjectYes-위 테이블의 모델별 파라미터를 포함하는 객체
output_folderstringNo-결과물 저장 폴더 경로 (최대 256자, '..' 사용 불가)
webhook_urlstringNo-완료 시 호출할 Webhook URL
is_publicbooleanNofalsetrue 시 결과물을 영구 공개 URL로도 제공

예제

밝은 마무리 인사

밝고 친근한 스타일 지시문을 붙인 짧은 문장입니다.

curl -X POST "https://api.core.today/v1/predictions" \
  -H "Content-Type: application/json" \
  -H "X-API-Key: cdt_your_api_key" \
  -d '{
  "model": "google/gemini-3.8-flash-tts",
  "input": {
    "prompt": "Have a wonderful day!",
    "style_instructions": "cheerful and friendly",
    "voice": "Kore"
  }
}'

차분한 한국어 다큐 내레이션

느리고 차분하게 읽도록 지시한 한국어 내레이션입니다.

curl -X POST "https://api.core.today/v1/predictions" \
  -H "Content-Type: application/json" \
  -H "X-API-Key: cdt_your_api_key" \
  -d '{
  "model": "google/gemini-3.8-flash-tts",
  "input": {
    "prompt": "깊은 바다 아래, 빛이 닿지 않는 곳에서도 생명은 조용히 이어집니다.",
    "style_instructions": "calm, slow documentary narration with a warm low voice",
    "voice": "Charon"
  }
}'

팁 & 모범 사례

1전달 방식은 style_instructions에 두세요 — 이 필드는 과금되지 않고, prompt의 내용은 모두 발화·과금됩니다.
2자연스러운 반응에는 prompt 안에 <laugh>, <sigh> 같은 인라인 이벤트를 쓰세요.
32인 대화 모드는 아직 게이트웨이에서 제공하지 않으므로 화자별 대사를 개별 요청으로 생성하세요.
4출력은 WAV이므로 압축 형식이 필요하면 후처리에서 변환하세요.

사용 사례

톤을 정밀하게 지시한 내레이션(차분한 다큐, 경쾌한 홍보)
앱·어시스턴트의 음성 안내와 인사말
팟캐스트 인트로와 짧은 음성 구간
하나의 파이프라인으로 만드는 다국어 음성 콘텐츠