GLM-5.3은 Z.ai의 국제 플랫폼(api.z.ai)의 플래그십 추론 모델로, GLM-5.2를 기반으로 코딩 능력을 강화하고 복잡한 소프트웨어 엔지니어링과 장기 에이전트 작업에서 성능과 토큰 효율의 균형을 개선했습니다. Thinking은 항상 켜져 있으며, low/high/max 세 단계의 추론 강도로 비용과 깊이를 조절할 수 있습니다. 프롬프트 캐싱, 도구 호출(function calling), 웹 검색을 지원합니다. 컨텍스트 윈도우: 1M 토큰, 출력: 128K. OpenAI 및 Anthropic 프로토콜로 이용할 수 있습니다.

컨텍스트 윈도우
1M
최대 출력 토큰
128K
출시일
2026-08-19
기능
Function Calling추론프롬프트 캐싱웹 검색
제공업체
VolcengineZ.ai
지원 프로토콜
openaianthropic

Providers

Volcengine
입력 토큰
$1.4/M
출력 토큰
$4.4/M
캐시 읽기
$0.26/M
웹 검색
$0.01/R
Protocols
openai/v1/chat/completions/v1/responses
anthropic
Z.ai
입력 토큰
$1.4/M
출력 토큰
$4.4/M
캐시 읽기
$0.26/M
웹 검색
$0.01/R
Protocols
openai/v1/chat/completions
anthropic

코드 예제

from openai import OpenAI
client = OpenAI(
base_url="https://api.ofox.run/v1",
api_key="YOUR_OFOX_API_KEY",
)
response = client.chat.completions.create(
model="z-ai/glm-5.3",
messages=[
{"role": "user", "content": "Hello!"}
],
)
print(response.choices[0].message.content)

가동 시간 및 상태

자주 묻는 질문

Z.ai: GLM-5.3은(는) Ofox.ai에서 입력 $1.4/M/백만 토큰, 출력 $4.4/M/백만 토큰입니다. 종량제, 월정액 없음.