Skip to main content
Core.Today
|
DeepSeek빠름높음

DeepSeek Flash (V4.1)

DeepSeek의 빠르고 저렴한 모델로, 현재 DeepSeek V4.1 Flash이며 텍스트와 이미지 입력을 지원합니다. thinking 모드가 기본이며 1M 토큰 컨텍스트, 최대 384K 출력 토큰, 약 98% 할인된 캐시 읽기를 제공합니다. 백만 토큰당 입력 $0.30 / 출력 $1.20입니다.

557/2,230크레딧
입력 / 출력 · 100만 토큰당
최고 수준의 가격 대비 성능
텍스트·이미지 입력
1M 컨텍스트 윈도우, 최대 384K 출력 토큰
thinking 모드 기본 활성 (요청 파라미터로 전환 가능)
OpenAI 호환 API (chat completions)
컨텍스트 캐시 히트 시 약 98% 할인 단가

지금 바로 실행해보세요

콘솔의 Playground에서 별도 코드 없이 이 모델을 즉시 테스트할 수 있어요

로그인 후 사용해보기

AI 어시스턴트에서 사용하기

이 모델의 사용법을 Claude, ChatGPT 등에 복사

모델 상세 사양

컨텍스트 윈도우
1.0M
토큰
최대 출력
393K
토큰
학습 데이터
2025-05
호환 SDK
OpenAI

기능 지원

비전
함수 호출
스트리밍
JSON 모드
시스템 프롬프트

토큰별 가격 (1M 토큰당)

토큰 종류크레딧달러 환산
입력 토큰557$0.37
출력 토큰2,230$1.49
캐시된 토큰11.148$0.01

* 1,500 크레딧 ≈ $1 (실제 요금은 사용량에 따라 달라질 수 있습니다)

빠른 시작

curl -X POST "https://api.core.today/llm/deepseek/v1/chat/completions" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer cdt_your_api_key" \
  -d '{
  "model": "deepseek-flash",
  "messages": [
    {
      "role": "user",
      "content": "Explain vector databases in 3 sentences."
    }
  ],
  "max_tokens": 1024
}'

파라미터

파라미터타입필수기본값설명
modelstringYes-모델 ID입니다. 예: "deepseek-flash".
messagesarrayYes-OpenAI 형식의 대화 메시지 배열입니다 (system/user/assistant 역할).
temperaturenumberNo0.7샘플링 온도입니다 (0~2).
max_tokensintegerNo2048최대 완성 토큰 수입니다.
streambooleanNofalseSSE 스트리밍 응답 여부입니다.

예제

챗 컴플리션

OpenAI 호환 챗 컴플리션 요청

curl -X POST "https://api.core.today/llm/deepseek/v1/chat/completions" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer cdt_your_api_key" \
  -d '{
  "model": "deepseek-flash",
  "messages": [
    {
      "role": "user",
      "content": "Explain vector databases in 3 sentences."
    }
  ],
  "max_tokens": 1024
}'

팁 & 모범 사례

1OpenAI SDK에서 base_url을 https://ai.api.core.today/llm/deepseek/v1로 바꾸면 그대로 동작합니다
2thinking 모드가 기본입니다 - 지연에 민감한 호출은 요청 단위로 비활성화하세요
3캐시 히트는 약 98% 할인 과금됩니다 - 긴 시스템 프롬프트와 공통 프리픽스를 재사용하세요
4시간대와 무관하게 DeepSeek 표준(피크) 단가로 과금됩니다 - 오프피크 할인은 적용되지 않습니다
5게이트웨이는 Anthropic 포맷 엔드포인트를 지원하지 않습니다 - OpenAI 포맷을 사용하세요
6시간대와 무관하게 DeepSeek 표준(피크) 단가로 과금됩니다 — DeepSeek 오프피크 할인은 적용되지 않습니다

사용 사례

저비용 대량 챗·요약 처리
1M 컨텍스트를 활용한 긴 문서 분석
레거시 deepseek-v4-flash id 및 retire된 deepseek-chat / deepseek-reasoner 마이그레이션 대상