Skip to main content
Core.Today
|
Google빠름표준

Gemini 3.5 Flash Lite

고처리량·저비용 워크로드를 위한 Google의 경량 Gemini 3.5 모델입니다 (2026-07-21 출시). 백만 토큰당 $0.30/$2.50이며 캐시 입력은 $0.03/M입니다. 2027-05-07 종료 예정인 Gemini 3.1 Flash Lite의 후속 모델입니다.

557/4,645크레딧
입력 / 출력 · 100만 토큰당
저지연 경량 Gemini 3.5 티어
1,048,576 토큰 컨텍스트 윈도우
65,536 최대 출력 토큰
멀티모달 입력: 텍스트·이미지·오디오·비디오·PDF
캐시 입력 가격 (90% 할인)
함수 호출, 구조화 출력, Thinking, 검색 그라운딩

지금 바로 실행해보세요

콘솔의 Playground에서 별도 코드 없이 이 모델을 즉시 테스트할 수 있어요

로그인 후 사용해보기

AI 어시스턴트에서 사용하기

이 모델의 사용법을 Claude, ChatGPT 등에 복사

모델 상세 사양

컨텍스트 윈도우
1.0M
토큰
최대 출력
66K
토큰
학습 데이터
January 2025
호환 SDK
OpenAI, Google AI

기능 지원

비전
함수 호출
스트리밍
JSON 모드
시스템 프롬프트

토큰별 가격 (1M 토큰당)

토큰 종류크레딧달러 환산
입력 토큰557$0.37
출력 토큰4,645$3.10
캐시된 토큰55.74$0.04

* 1,500 크레딧 ≈ $1 (실제 요금은 사용량에 따라 달라질 수 있습니다)

빠른 시작

curl -X POST "https://api.core.today/llm/gemini/v1beta/openai/chat/completions" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer cdt_your_api_key" \
  -d '{
  "model": "gemini-3.5-flash-lite",
  "messages": [
    {
      "role": "system",
      "content": "Classify the following text as: spam, not_spam. Respond with only the label."
    },
    {
      "role": "user",
      "content": "Congratulations! You have been selected for a special prize. Click here to claim now!"
    }
  ],
  "max_tokens": 50,
  "temperature": 0
}'

파라미터

파라미터타입필수기본값설명
messagesarrayYes-메시지 객체 배열 (OpenAI 형식). 텍스트·이미지·오디오·비디오·PDF 입력을 지원합니다.
temperaturefloatNo1샘플링 온도 (0-2). 낮을수록 결정적인 출력을 생성합니다.
max_tokensintegerNo-최대 출력 토큰 수. 최대값: 65,536. 컨텍스트 윈도우 (입력+출력): 1,048,576 토큰.
response_formatobjectNo-출력 형식 제약. 구조화된 JSON 출력에는 `{ type: 'json_object' }`를 사용하세요.
streambooleanNofalseServer-Sent Events 스트리밍 활성화.

예제

빠른 분류

Flash Lite를 활용한 경량 텍스트 분류

curl -X POST "https://api.core.today/llm/gemini/v1beta/openai/chat/completions" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer cdt_your_api_key" \
  -d '{
  "model": "gemini-3.5-flash-lite",
  "messages": [
    {
      "role": "system",
      "content": "Classify the following text as: spam, not_spam. Respond with only the label."
    },
    {
      "role": "user",
      "content": "Congratulations! You have been selected for a special prize. Click here to claim now!"
    }
  ],
  "max_tokens": 50,
  "temperature": 0
}'

팁 & 모범 사례

1백만 토큰당 $0.30/$2.50 — 출력 단가가 3.1 Flash Lite($1.50)보다 높으니 실제 출력 길이로 비교하세요
2Gemini 3.1 Flash Lite는 2027-05-07 종료 — 그 전에 이 모델로 이전하세요
3반복 컨텍스트에는 캐시 입력($0.03/M, 90% 할인) 활용
4대량 분류 및 라우팅 작업에 이상적
5Priority inference(serviceTier: priority) 요청은 토큰 요금이 1.8배입니다. flex·batch 할인은 적용되지 않고 표준 단가로 정산됩니다

사용 사례

대량 텍스트 처리
실시간 채팅 애플리케이션
빠른 분류 및 라우팅
경량 데이터 추출
Gemini 3.1 Flash Lite 마이그레이션 대상

모델 정보

제공자Google
버전3.5
카테고리LLM
가격1 크레딧

API Endpoint

POST /llm/gemini/v1beta/openai/chat/completions
콘솔에서 테스트문서로 돌아가기