Skip to main content
Z.ai빠름높음

GLM 4.7

OpenRouter 애그리게이터를 경유하는 Z.ai GLM 4.7입니다. 프로그래밍 능력과 다단계 추론·실행 안정성이 강화된 플래그십 텍스트 모델로, 복잡한 에이전트 작업에서 뚜렷한 개선을 보입니다. 200K 컨텍스트를 지원하며 OpenRouter 실사용 비용 기준으로 실비 정산됩니다.

743/3,252크레딧
입력 / 출력 · 100만 토큰당
200K 토큰 컨텍스트 윈도우, 최대 128K 출력 토큰
강화된 프로그래밍 능력과 안정적인 다단계 추론·실행
텍스트 전용 입력·출력, 추론(reasoning) 모드 지원
OpenAI 호환 API (chat completions) — /llm/openrouter/v1
OpenRouter 실사용 비용(usage.cost) 기준 실비 정산 — 표시 단가는 추정치

지금 바로 실행해보세요

콘솔의 Playground에서 별도 코드 없이 이 모델을 즉시 테스트할 수 있어요

로그인 후 사용해보기

AI 어시스턴트에서 사용하기

이 모델의 사용법을 Claude, ChatGPT 등에 복사

모델 상세 사양

컨텍스트 윈도우
205K
토큰
최대 출력
131K
토큰
학습 데이터
Not published
호환 SDK
OpenAI

기능 지원

비전
함수 호출
스트리밍
JSON 모드
시스템 프롬프트

토큰별 가격 (1M 토큰당)

토큰 종류크레딧달러 환산
입력 토큰743$0.50
출력 토큰3,252$2.17
캐시된 토큰148.64$0.10

* 1,500 크레딧 ≈ $1 (실제 요금은 사용량에 따라 달라질 수 있습니다)

빠른 시작

curl -X POST "https://api.core.today/llm/openrouter/v1/chat/completions" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer cdt_your_api_key" \
  -d '{
  "model": "z-ai/glm-4.7",
  "messages": [
    {
      "role": "user",
      "content": "Summarize the attached report in 5 bullets."
    }
  ],
  "max_tokens": 1024
}'

파라미터

파라미터타입필수기본값설명
modelstringYes-모델 ID입니다 (vendor/model 형식). 예: "z-ai/glm-4.7".
messagesarrayYes-OpenAI 형식의 대화 메시지 배열입니다 (system/user/assistant 역할).
temperaturenumberNo0.7샘플링 온도입니다 (0~2).
max_tokensintegerNo2048최대 완성 토큰 수입니다.
streambooleanNofalseSSE 스트리밍 응답 여부입니다.

예제

챗 컴플리션

OpenRouter 경유 OpenAI 호환 챗 컴플리션 요청

curl -X POST "https://api.core.today/llm/openrouter/v1/chat/completions" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer cdt_your_api_key" \
  -d '{
  "model": "z-ai/glm-4.7",
  "messages": [
    {
      "role": "user",
      "content": "Summarize the attached report in 5 bullets."
    }
  ],
  "max_tokens": 1024
}'

팁 & 모범 사례

1OpenAI SDK에서 base_url을 https://ai.api.core.today/llm/openrouter/v1로 바꾸면 그대로 동작합니다
2청구는 OpenRouter usage.cost × 1,858 크레딧/USD 실비입니다 - 표시 단가는 추정치라 OpenRouter 가격 변동 시 차이가 날 수 있습니다
3텍스트 전용이며 GLM 5.2보다 저렴합니다 - 코딩·에이전트 루프의 기본값으로 적합하고, 1M 컨텍스트가 필요할 때 GLM 5.2로 올리세요

사용 사례

코딩 어시스턴트·코드 생성
도구를 활용한 다단계 에이전트 작업 실행
비용 효율적인 일반 챗·추론