Z.ai: GLM-5.3

Chat
z-ai/glm-5.3

GLM-5.3 est le modèle de raisonnement phare de la plateforme internationale de Z.ai (api.z.ai), qui améliore GLM-5.2 avec une meilleure capacité de programmation et un meilleur équilibre performance/efficacité en tokens pour l'ingénierie logicielle complexe et les tâches d'agents de longue haleine. La réflexion est toujours activée, avec trois niveaux d'effort de raisonnement (low/high/max) pour ajuster le coût par rapport à la profondeur. Il prend en charge la mise en cache des prompts, l'appel d'outils (function calling) et la recherche web. Fenêtre de contexte : 1M tokens, sortie : 128K. Disponible via les protocoles OpenAI et Anthropic.

Fenêtre de contexte
1M
Tokens de sortie max
128K
Publié
2026-08-19
Capacités
Function CallingRaisonnementPrompt CachingRecherche web
Fournisseurs disponibles
VolcengineZ.ai
Protocoles supportés
openaianthropic

Providers

Volcengine
Tokens d'entrée
$1.4/M
Tokens de sortie
$4.4/M
Lecture cache
$0.26/M
Recherche web
$0.01/R
Protocols
openai/v1/chat/completions/v1/responses
anthropic
Z.ai
Tokens d'entrée
$1.4/M
Tokens de sortie
$4.4/M
Lecture cache
$0.26/M
Recherche web
$0.01/R
Protocols
openai/v1/chat/completions
anthropic

Exemples de code

from openai import OpenAI
client = OpenAI(
base_url="https://api.ofox.run/v1",
api_key="YOUR_OFOX_API_KEY",
)
response = client.chat.completions.create(
model="z-ai/glm-5.3",
messages=[
{"role": "user", "content": "Hello!"}
],
)
print(response.choices[0].message.content)

Disponibilité et état

Questions fréquentes

Z.ai: GLM-5.3 sur Ofox.ai coûte $1.4/M par million de tokens d'entrée et $4.4/M par million de tokens de sortie. Paiement à l'usage, sans frais mensuels.