Z.ai: GLM-5.3

Chat
z-ai/glm-5.3

GLM-5.3 ist das Flagship-Reasoning-Modell auf Z.ais internationaler Plattform (api.z.ai) und verbessert GLM-5.2 durch stärkere Coding-Fähigkeiten und ein besseres Verhältnis von Leistung zu Token-Effizienz für komplexe Softwareentwicklung und langfristige Agenten-Aufgaben. Thinking ist durchgehend aktiv, mit drei Stufen der Denkintensität (low/high/max) zur Abwägung von Kosten und Tiefe. Unterstützt werden Prompt-Caching, Werkzeugaufrufe (Function Calling) und Websuche. Kontextfenster: 1M Tokens, Ausgabe: 128K. Verfügbar über die Protokolle OpenAI und Anthropic.

Kontextfenster
1M
Max. Ausgabe-Tokens
128K
Veröffentlicht
2026-08-19
Fähigkeiten
Function CallingReasoningPrompt CachingWebsuche
Verfügbare Anbieter
VolcengineZ.ai
Unterstützte Protokolle
openaianthropic

Providers

Volcengine
Eingabe-Tokens
$1.4/M
Ausgabe-Tokens
$4.4/M
Cache-Lesen
$0.26/M
Websuche
$0.01/R
Protocols
openai/v1/chat/completions/v1/responses
anthropic
Z.ai
Eingabe-Tokens
$1.4/M
Ausgabe-Tokens
$4.4/M
Cache-Lesen
$0.26/M
Websuche
$0.01/R
Protocols
openai/v1/chat/completions
anthropic

Code-Beispiele

from openai import OpenAI
client = OpenAI(
base_url="https://api.ofox.run/v1",
api_key="YOUR_OFOX_API_KEY",
)
response = client.chat.completions.create(
model="z-ai/glm-5.3",
messages=[
{"role": "user", "content": "Hello!"}
],
)
print(response.choices[0].message.content)

Verfügbarkeit & Status

Häufig gestellte Fragen

Z.ai: GLM-5.3 auf Ofox.ai kostet $1.4/M pro Million Eingabe-Tokens und $4.4/M pro Million Ausgabe-Tokens. Pay-as-you-go, keine monatlichen Gebühren.