Skip to main content
Core.Today
|
Google빠름높음

Gemini 3.7 Flash

Google의 Gemini 3.7 Flash입니다 (2026-08-13 출시). Gemini 3.x Flash 라인의 이전 릴리스로, 더 새로운 Flash 세대(3.8)가 나와 있습니다. 1M 토큰 컨텍스트 윈도우와 65,536 최대 출력 토큰, 멀티모달 입력, Thinking·도구 사용을 지원하며, 가격은 백만 토큰당 입력 $1.50 / 출력 $7.50, 캐시 입력 $0.15/M입니다.

2,787/13,935크레딧
입력 / 출력 · 100만 토큰당
Gemini 3.7 Flash 세대 (2026-08-13 출시)
1,048,576 토큰 컨텍스트 윈도우
65,536 최대 출력 토큰
멀티모달 입력: 텍스트·이미지·오디오·비디오·PDF
캐시 입력 가격 (90% 할인)
함수 호출, 구조화 출력, Thinking, 검색 그라운딩, 코드 실행

지금 바로 실행해보세요

콘솔의 Playground에서 별도 코드 없이 이 모델을 즉시 테스트할 수 있어요

로그인 후 사용해보기

AI 어시스턴트에서 사용하기

이 모델의 사용법을 Claude, ChatGPT 등에 복사

모델 상세 사양

컨텍스트 윈도우
1.0M
토큰
최대 출력
66K
토큰
학습 데이터
2025-01
호환 SDK
OpenAI, Google AI

기능 지원

비전
함수 호출
스트리밍
JSON 모드
시스템 프롬프트

토큰별 가격 (1M 토큰당)

토큰 종류크레딧달러 환산
입력 토큰2,787$1.86
출력 토큰13,935$9.29
캐시된 토큰278.7$0.19

* 1,500 크레딧 ≈ $1 (실제 요금은 사용량에 따라 달라질 수 있습니다)

빠른 시작

curl -X POST "https://api.core.today/llm/gemini/v1beta/openai/chat/completions" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer cdt_your_api_key" \
  -d '{
  "model": "gemini-3.7-flash",
  "messages": [
    {
      "role": "user",
      "content": "Explain the difference between ECS and EKS briefly."
    }
  ],
  "stream": true,
  "max_tokens": 800
}'

파라미터

파라미터타입필수기본값설명
messagesarrayYes-메시지 객체 배열 (OpenAI 형식). 텍스트·이미지·오디오·비디오·PDF 입력을 지원합니다.
temperaturefloatNo1샘플링 온도 (0-2). 낮을수록 결정적인 출력을 생성합니다.
max_tokensintegerNo-최대 출력 토큰 수. 최대값: 65,536. 컨텍스트 윈도우 (입력+출력): 1,048,576 토큰.
response_formatobjectNo-출력 형식 제약. 구조화된 JSON 출력에는 `{ type: 'json_object' }`를 사용하세요.
streambooleanNofalseServer-Sent Events 스트리밍 활성화.

예제

프로덕션 챗

스트리밍 기반 고처리량 어시스턴트 응답

curl -X POST "https://api.core.today/llm/gemini/v1beta/openai/chat/completions" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer cdt_your_api_key" \
  -d '{
  "model": "gemini-3.7-flash",
  "messages": [
    {
      "role": "user",
      "content": "Explain the difference between ECS and EKS briefly."
    }
  ],
  "stream": true,
  "max_tokens": 800
}'

문서 추출

긴 문서에서 구조화된 필드 추출

curl -X POST "https://api.core.today/llm/gemini/v1beta/openai/chat/completions" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer cdt_your_api_key" \
  -d '{
  "model": "gemini-3.7-flash",
  "messages": [
    {
      "role": "user",
      "content": "Summarize the attached contract PDF and list every deadline it mentions."
    }
  ],
  "response_format": {
    "type": "json_object"
  },
  "max_tokens": 2000
}'

팁 & 모범 사례

1Gemini 3.8 Flash와 가격이 같습니다($1.50/$7.50) - 신규 프로젝트에는 최신 세대 gemini-3.8-flash를 권장하며, 이 버전의 동작이 필요할 때만 gemini-3.7-flash를 고정하세요
2반복 컨텍스트에는 캐시 입력($0.15/M, 90% 할인) 활용
3최대 출력은 65,536 토큰 — 매우 긴 생성은 분할하세요
4단순 대량 작업은 Gemini 3.5 Flash Lite($0.30/$2.50)로 강등
5Priority inference(serviceTier: priority) 요청은 토큰 요금이 1.8배입니다. flex·batch 할인은 적용되지 않고 표준 단가로 정산됩니다

사용 사례

대량 프로덕션 챗 워크로드
멀티모달 이해 (이미지·비디오·오디오·PDF)
긴 문서 및 코드베이스 분석
대규모 데이터 추출 및 요약
캐시 입력 활용 반복 컨텍스트 (RAG)

모델 정보

제공자Google
버전3.7
카테고리LLM
가격1 크레딧

API Endpoint

POST /llm/gemini/v1beta/openai/chat/completions
콘솔에서 테스트문서로 돌아가기