Skip to main content
Core.Today
|
Google빠름높음

Gemini 3.1 Flash TTS

Replicate를 통해 제공되는 Google Gemini 3.1 Flash 네이티브 오디오 TTS입니다. 실제 발화 텍스트와 별도의 스타일 지시문, 30종의 프리셋 음성, 40개 이상의 언어/로케일 코드를 지원하며, [sigh], [whispering], [shouting] 등 인라인 마크업 태그로 감정 표현이 가능합니다.

299 크레딧
1000자당 (입력 텍스트 + 생성 음성 기준)
Gemini 3.1 Flash 기반 네이티브 오디오 TTS
실제 발화 텍스트와 분리된 스타일 지시문(prompt) 필드
30종의 프리셋 음성
한국어, 일본어, 스페인어, 프랑스어, 독일어 등 40개 이상의 언어/로케일 코드(BCP-47) 지원
[sigh], [laughing], [whispering], [shouting], [extremely fast] 등 인라인 마크업 태그로 표현력 있는 발화 지원

지금 바로 실행해보세요

콘솔의 Playground에서 별도 코드 없이 이 모델을 즉시 테스트할 수 있어요

로그인 후 사용해보기

AI 어시스턴트에서 사용하기

이 모델의 사용법을 Claude, ChatGPT 등에 복사

빠른 시작

curl -X POST "https://api.core.today/v1/predictions" \
  -H "Content-Type: application/json" \
  -H "X-API-Key: cdt_your_api_key" \
  -d '{
  "model": "google/gemini-3.1-flash-tts",
  "input": {
    "prompt": "Say this in a calm, professional tone, like a documentary narrator.",
    "text": "오늘 소개할 제품은 최신 무선 이어폰입니다. 뛰어난 음질과 편안한 착용감을 동시에 제공합니다.",
    "voice": "Kore",
    "language_code": "ko-KR"
  }
}'

파라미터

파라미터타입필수기본값설명
promptstringNoSay the following.텍스트를 어떤 방식으로 말할지 제어하는 스타일 지시문입니다. 원하는 톤, 속도, 억양, 감정을 자연어로 설명하세요. 예: '차분하고 전문적인 톤으로 말해줘' 또는 '흥분되고 에너지 넘치게 말해줘'. 최대 4,000바이트.
textstringYes-음성으로 변환할 텍스트입니다. 표현력 있는 발화를 위해 [sigh], [laughing], [whispering], [shouting], [extremely fast] 같은 마크업 태그를 지원합니다. 최대 4,000바이트.
voicestringNoKore음성 생성에 사용할 보이스입니다.
AchernarAchirdAlgenibAlgiebaAlnilamAoedeAutonoeCallirrhoeCharonDespinaEnceladusErinomeFenrirGacruxIapetusKoreLaomedeiaLedaOrusPulcherrimaPuckRasalgethiSadachbiaSadaltagerSchedarSulafatUmbrielVindemiatrixZephyrZubenelgenubi
language_codestringNoen-US생성될 음성의 언어입니다.
af-ZAam-ETar-001ar-EGaz-AZbe-BYbg-BGbn-BDca-ESceb-PHcmn-CNcmn-twcs-CZda-DKde-DEel-GRen-AUen-GBen-INen-USes-419es-ESes-MXet-EEeu-ESfa-IRfi-FIfil-PHfr-CAfr-FRgl-ESgu-INhe-ILhi-INhr-HRht-HThu-HUhy-AMid-IDis-ISit-ITja-JPjv-JVka-GEkn-INko-KRkok-INla-VAlb-LUlo-LAlt-LTlv-LVmai-INmg-MGmk-MKml-INmn-MNmr-INms-MYmy-MMnb-NOne-NPnl-NLnn-NOor-INpa-INpl-PLps-AFpt-BRpt-PTro-ROru-RUsd-INsi-LKsk-SKsl-SIsq-ALsr-RSsv-SEsw-KEta-INte-INth-THtr-TRuk-UAur-PKvi-VN

공통 파라미터

POST /v1/predictions 요청 시 사용되는 공통 파라미터입니다.

파라미터타입필수기본값설명
modelstringYes-모델 식별자
inputobjectYes-위 테이블의 모델별 파라미터를 포함하는 객체
output_folderstringNo-결과물 저장 폴더 경로 (최대 256자, '..' 사용 불가)
webhook_urlstringNo-완료 시 호출할 Webhook URL
is_publicbooleanNofalsetrue 시 결과물을 영구 공개 URL로도 제공

예제

스타일 지시문을 적용한 한국어 내레이션

Kore 보이스로 차분하고 전문적인 톤의 한국어 내레이션을 생성합니다.

curl -X POST "https://api.core.today/v1/predictions" \
  -H "Content-Type: application/json" \
  -H "X-API-Key: cdt_your_api_key" \
  -d '{
  "model": "google/gemini-3.1-flash-tts",
  "input": {
    "prompt": "Say this in a calm, professional tone, like a documentary narrator.",
    "text": "오늘 소개할 제품은 최신 무선 이어폰입니다. 뛰어난 음질과 편안한 착용감을 동시에 제공합니다.",
    "voice": "Kore",
    "language_code": "ko-KR"
  }
}'

마크업 태그를 활용한 영어 표현 발화

영어로 흥분되고 표현력 있는 발화를 위해 인라인 마크업 태그를 사용합니다.

curl -X POST "https://api.core.today/v1/predictions" \
  -H "Content-Type: application/json" \
  -H "X-API-Key: cdt_your_api_key" \
  -d '{
  "model": "google/gemini-3.1-flash-tts",
  "input": {
    "prompt": "Speak with excitement and energy, like announcing a big surprise.",
    "text": "[laughing] You won't believe this offer — it's fifty percent off, today only! [extremely fast] Don't miss out!",
    "voice": "Puck",
    "language_code": "en-US"
  }
}'

팁 & 모범 사례

1톤·속도·감정 지시는 `prompt`에, 실제로 말할 문장은 `text`에 넣으세요 — 두 필드는 서로 분리되어 있습니다
2[whispering], [sigh], [shouting] 같은 마크업 태그는 `prompt`가 아닌 `text` 안에 직접 넣어야 표현력 있는 발화가 적용됩니다
3정확한 발음을 위해 language_code를 `text`의 언어와 일치시키세요 (한국어는 ko-KR)
4prompt와 text 모두 각각 4,000바이트 이내로 유지하세요

사용 사례

영상 콘텐츠용 다국어 내레이션 및 보이스오버
마크업 태그와 스타일 지시문을 활용한 감정 표현이 풍부한 캐릭터 보이스
40개 이상의 언어를 지원하는 앱/제품용 현지화 오디오
최종 제작 전 스크립트 음성을 빠르게 프로토타이핑