Z.ai: GLM-5.3

Chat
z-ai/glm-5.3

GLM-5.3 es el modelo de razonamiento insignia de la plataforma internacional de Z.ai (api.z.ai), que mejora GLM-5.2 con una capacidad de programación más sólida y un mejor equilibrio entre rendimiento y eficiencia de tokens para tareas complejas de ingeniería de software y agentes de largo alcance. El pensamiento está siempre activo, con tres niveles de esfuerzo de razonamiento (low/high/max) para ajustar el coste frente a la profundidad. Admite almacenamiento en caché de prompts, uso de herramientas (function calling) y búsqueda web. Ventana de contexto: 1M tokens, salida: 128K. Disponible mediante los protocolos OpenAI y Anthropic.

Ventana de Contexto
1M
Tokens de Salida Máximos
128K
Lanzamiento
2026-08-19
Capacidades
Function CallingRazonamientoPrompt CachingBúsqueda Web
Proveedores Disponibles
VolcengineZ.ai
Protocolos Soportados
openaianthropic

Providers

Volcengine
Tokens de Entrada
$1.4/M
Tokens de Salida
$4.4/M
Lectura de Caché
$0.26/M
Búsqueda Web
$0.01/R
Protocols
openai/v1/chat/completions/v1/responses
anthropic
Z.ai
Tokens de Entrada
$1.4/M
Tokens de Salida
$4.4/M
Lectura de Caché
$0.26/M
Búsqueda Web
$0.01/R
Protocols
openai/v1/chat/completions
anthropic

Ejemplos de Código

from openai import OpenAI
client = OpenAI(
base_url="https://api.ofox.run/v1",
api_key="YOUR_OFOX_API_KEY",
)
response = client.chat.completions.create(
model="z-ai/glm-5.3",
messages=[
{"role": "user", "content": "Hello!"}
],
)
print(response.choices[0].message.content)

Disponibilidad y estado

Preguntas Frecuentes

Z.ai: GLM-5.3 en Ofox.ai cuesta $1.4/M por millón de tokens de entrada y $4.4/M por millón de tokens de salida. Pago por uso, sin cuotas mensuales.