화자 분리(diarization)가 포함된 Whisper 전사입니다 (800만+ 실행). 누가 무엇을 말했는지 세그먼트별 화자 라벨과 타임스탬프로 반환합니다. 회의·인터뷰 전사의 정석입니다.
콘솔의 Playground에서 별도 코드 없이 이 모델을 즉시 테스트할 수 있어요
이 모델의 사용법을 Claude, ChatGPT 등에 복사
curl -X POST "https://api.core.today/v1/predictions" \
-H "Content-Type: application/json" \
-H "X-API-Key: cdt_your_api_key" \
-d '{
"model": "thomasmol/whisper-diarization",
"input": {
"file_url": "https://example.com/interview.mp3",
"num_speakers": 2,
"language": "ko",
"prompt": "코어닷투데이, API, 크레딧"
}
}'| 파라미터 | 타입 | 필수 | 기본값 | 설명 |
|---|---|---|---|---|
prompt | string | No | - | 정확도 향상을 위한 이름·약어·외래어 목록 |
file_string | string | No | - | 다음 중 하나 제공: Base64로 인코딩된 오디오 파일, |
file_url | string | No | - | 오디오 파일 URL (또는 'file' 업로드 사용) |
file | string | No | - | 또는 오디오 파일 |
num_speakers | integer | No | - | 화자 수. 비우면 자동 감지 |
translate | boolean | No | false | 음성을 영어로 번역 |
language | string | No | - | 'ko', 'en' 같은 언어 코드. 비우면 자동 감지 |
POST /v1/predictions 요청 시 사용되는 공통 파라미터입니다.
| 파라미터 | 타입 | 필수 | 기본값 | 설명 |
|---|---|---|---|---|
model | string | Yes | - | 모델 식별자 |
input | object | Yes | - | 위 테이블의 모델별 파라미터를 포함하는 객체 |
output_folder | string | No | - | 결과물 저장 폴더 경로 (최대 256자, '..' 사용 불가) |
webhook_url | string | No | - | 완료 시 호출할 Webhook URL |
is_public | boolean | No | false | true 시 결과물을 영구 공개 URL로도 제공 |
화자 2명 라벨과 함께 전사
curl -X POST "https://api.core.today/v1/predictions" \
-H "Content-Type: application/json" \
-H "X-API-Key: cdt_your_api_key" \
-d '{
"model": "thomasmol/whisper-diarization",
"input": {
"file_url": "https://example.com/interview.mp3",
"num_speakers": 2,
"language": "ko",
"prompt": "코어닷투데이, API, 크레딧"
}
}'