20 % auf alle GPT 🎉 30 % auf DeepSeekMehr erfahren

Z.ai: GLM-5.3-FlashX

Chat
z-ai/glm-5.3-flashx

GLM-5.3-FlashX ist ein leichtgewichtiges Hochgeschwindigkeitsmodell des internationalen Angebots von z.ai (api.z.ai) für Coding und Long-Range-Agenten. Mit einer Inferenzgeschwindigkeit von bis zu 200 tokens/s sorgt es für ein schnelleres Modellerlebnis. Es bietet native Multimodalität (Bilder, Videos), 1M Kontext, stets aktiviertes Denken (nicht abschaltbar, unterstützt drei Stufen: low, max), Prompt-Aufrufe und Web Search sowie eine duale Anbindung über OpenAI und Anthropic (der Responses-Endpunkt wird nicht unterstützt).

Kontextfenster
1M
Max. Ausgabe-Tokens
131K
Veröffentlicht
2026-08-26
Fähigkeiten
VisionFunction CallingReasoningPrompt CachingWebsucheVideo-Eingabe
Verfügbare Anbieter
Z.ai
Unterstützte Protokolle
openaianthropic

Providers

Z.aiprovider.type: "zai"
Eingabe-Tokens
$0.15/M
Ausgabe-Tokens
$0.5/M
Cache-Lesen
$0.03/M
Websuche
$0.01/R
Protocols
openai/v1/chat/completions
anthropic

Code-Beispiele

from openai import OpenAI
client = OpenAI(
base_url="https://api.ofox.run/v1",
api_key="YOUR_OFOX_API_KEY",
)
response = client.chat.completions.create(
model="z-ai/glm-5.3-flashx",
messages=[
{"role": "user", "content": "Hello!"}
],
)
print(response.choices[0].message.content)

Häufig gestellte Fragen

Z.ai: GLM-5.3-FlashX auf Ofox.ai kostet $0.15/M pro Million Eingabe-Tokens und $0.5/M pro Million Ausgabe-Tokens. Pay-as-you-go, keine monatlichen Gebühren.