Skip to main content
Core.Today
|
Whisper빠름높음

Whisper Diarization

화자 분리(diarization)가 포함된 Whisper 전사입니다 (800만+ 실행). 누가 무엇을 말했는지 세그먼트별 화자 라벨과 타임스탬프로 반환합니다. 회의·인터뷰 전사의 정석입니다.

7 크레딧
실행당
화자 라벨이 붙는 전사 (누가 무엇을 말했는지)
세그먼트별 타임스탬프
화자 수 자동 감지 (직접 지정도 가능)
이름·전문용어 어휘 프롬프트
영어 번역 옵션

지금 바로 실행해보세요

콘솔의 Playground에서 별도 코드 없이 이 모델을 즉시 테스트할 수 있어요

로그인 후 사용해보기

AI 어시스턴트에서 사용하기

이 모델의 사용법을 Claude, ChatGPT 등에 복사

빠른 시작

curl -X POST "https://api.core.today/v1/predictions" \
  -H "Content-Type: application/json" \
  -H "X-API-Key: cdt_your_api_key" \
  -d '{
  "model": "thomasmol/whisper-diarization",
  "input": {
    "file_url": "https://example.com/interview.mp3",
    "num_speakers": 2,
    "language": "ko",
    "prompt": "코어닷투데이, API, 크레딧"
  }
}'

파라미터

파라미터타입필수기본값설명
promptstringNo-정확도 향상을 위한 이름·약어·외래어 목록
file_stringstringNo-다음 중 하나 제공: Base64로 인코딩된 오디오 파일,
file_urlstringNo-오디오 파일 URL (또는 'file' 업로드 사용)
filestringNo-또는 오디오 파일
num_speakersintegerNo-화자 수. 비우면 자동 감지
translatebooleanNofalse음성을 영어로 번역
languagestringNo-'ko', 'en' 같은 언어 코드. 비우면 자동 감지

공통 파라미터

POST /v1/predictions 요청 시 사용되는 공통 파라미터입니다.

파라미터타입필수기본값설명
modelstringYes-모델 식별자
inputobjectYes-위 테이블의 모델별 파라미터를 포함하는 객체
output_folderstringNo-결과물 저장 폴더 경로 (최대 256자, '..' 사용 불가)
webhook_urlstringNo-완료 시 호출할 Webhook URL
is_publicbooleanNofalsetrue 시 결과물을 영구 공개 URL로도 제공

예제

2인 인터뷰 전사

화자 2명 라벨과 함께 전사

curl -X POST "https://api.core.today/v1/predictions" \
  -H "Content-Type: application/json" \
  -H "X-API-Key: cdt_your_api_key" \
  -d '{
  "model": "thomasmol/whisper-diarization",
  "input": {
    "file_url": "https://example.com/interview.mp3",
    "num_speakers": 2,
    "language": "ko",
    "prompt": "코어닷투데이, API, 크레딧"
  }
}'

팁 & 모범 사례

1화자 수를 알면 num_speakers를 지정하세요 — 자동 감지는 비슷한 목소리를 과분리할 수 있습니다
2참석자 이름·제품 용어를 prompt에 넣으면 전사가 깔끔해집니다
3결과 세그먼트에 화자·시작/종료 시각·텍스트가 담겨 있어 회의록 UI에 바로 쓸 수 있습니다
4Whisper 3종 중 가장 저렴합니다 (9크레딧)

사용 사례

화자 표기가 있는 회의록
인터뷰 전사
멀티 호스트 팟캐스트 대본
콜센터 대화 분석
재판·토론 기록 디지털화