Skip to main content
Core.Today
|
Google빠름높음

Gemini 3.5 Flash

Google의 최신 Flash 티어 주력 모델입니다. 모든 입력 모달리티(텍스트·이미지·비디오·오디오·PDF)가 백만 토큰당 $1.50/$9의 동일 요율이며 롱 컨텍스트 할증이 없습니다. 1M 토큰 컨텍스트 윈도우와 65,536 최대 출력 토큰, 90% 할인된 캐시 입력을 지원합니다.

2,787/16,722크레딧
입력 / 출력 · 100만 토큰당
모든 입력 모달리티 동일 요율
롱 컨텍스트 할증 없음
1M 토큰 컨텍스트 윈도우
65,536 최대 출력 토큰
캐시 입력 가격 (90% 할인)
함수 호출, 구조화 출력, Thinking, 검색 그라운딩, 코드 실행

지금 바로 실행해보세요

콘솔의 Playground에서 별도 코드 없이 이 모델을 즉시 테스트할 수 있어요

로그인 후 사용해보기

AI 어시스턴트에서 사용하기

이 모델의 사용법을 Claude, ChatGPT 등에 복사

모델 상세 사양

컨텍스트 윈도우
1M
토큰
최대 출력
66K
토큰
학습 데이터
2025-01
호환 SDK
OpenAI, Google AI

기능 지원

비전
함수 호출
스트리밍
JSON 모드
시스템 프롬프트

토큰별 가격 (1M 토큰당)

토큰 종류크레딧달러 환산
입력 토큰2,787$1.86
출력 토큰16,722$11.15
캐시된 토큰279$0.19

* 1,500 크레딧 ≈ $1 (실제 요금은 사용량에 따라 달라질 수 있습니다)

빠른 시작

curl -X POST "https://api.core.today/llm/gemini/v1beta/openai/chat/completions" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer cdt_your_api_key" \
  -d '{
  "model": "gemini-3.5-flash",
  "messages": [
    {
      "role": "user",
      "content": "Summarize the attached contract PDF and list every deadline it mentions."
    }
  ],
  "max_tokens": 2000
}'

파라미터

파라미터타입필수기본값설명
messagesarrayYes-메시지 객체 배열 (OpenAI 형식). 텍스트·이미지·오디오·비디오·PDF 입력을 지원합니다.
temperaturefloatNo1샘플링 온도 (0-2). 낮을수록 결정적인 출력을 생성합니다.
max_tokensintegerNo-최대 출력 토큰 수. 최대값: 65,536. 컨텍스트 윈도우 (입력+출력): 1M 토큰.
response_formatobjectNo-출력 형식 제약. 구조화된 JSON 출력에는 `{ type: 'json_object' }`를 사용하세요.
streambooleanNofalseServer-Sent Events 스트리밍 활성화.

예제

멀티모달 문서 분석

텍스트와 동일 요율로 PDF 분석

curl -X POST "https://api.core.today/llm/gemini/v1beta/openai/chat/completions" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer cdt_your_api_key" \
  -d '{
  "model": "gemini-3.5-flash",
  "messages": [
    {
      "role": "user",
      "content": "Summarize the attached contract PDF and list every deadline it mentions."
    }
  ],
  "max_tokens": 2000
}'

프로덕션 챗

스트리밍 기반 고처리량 어시스턴트 응답

curl -X POST "https://api.core.today/llm/gemini/v1beta/openai/chat/completions" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer cdt_your_api_key" \
  -d '{
  "model": "gemini-3.5-flash",
  "messages": [
    {
      "role": "user",
      "content": "Explain the difference between ECS and EKS briefly."
    }
  ],
  "stream": true,
  "max_tokens": 800
}'

팁 & 모범 사례

1모달리티 동일 요율 — 비디오·오디오·PDF 입력도 텍스트와 같은 토큰 단가
2롱 컨텍스트 할증 없음: 200K 토큰 초과 입력도 동일 요율 (Gemini Pro 티어와 다름)
3반복 컨텍스트에는 캐시 입력($0.15/M, 90% 할인) 활용
4최대 출력은 65,536 토큰 — 매우 긴 생성은 분할하세요
5단순 대량 작업은 Gemini 3.1 Flash Lite($0.25/$1.50)로 강등

사용 사례

멀티모달 이해 (비디오·오디오·PDF)
대량 프로덕션 챗 워크로드
긴 문서 및 코드베이스 분석
대규모 데이터 추출 및 요약
캐시 입력 활용 반복 컨텍스트 (RAG)

모델 정보

제공자Google
버전3.5
카테고리LLM
가격2 크레딧

API Endpoint

POST /llm/gemini/v1beta/openai/chat/completions
콘솔에서 테스트문서로 돌아가기