GLM-4.6 es el modelo de chat de la serie GLM de Z.ai, lanzado el 30 de septiembre de 2025, con un sólido seguimiento de instrucciones y un excelente equilibrio entre rendimiento y coste, especialmente en tareas en chino. Admite razonamiento, llamada de funciones (uso de herramientas), caché de prompts y búsqueda web. Ventana de contexto: 200K tokens, salida: 128K. El precio es de $0.40/M tokens de entrada y $1.90/M de salida, con lectura de caché a $0.11/M. Disponible a través de los protocolos OpenAI y Anthropic.
Providers
/v1/chat/completionsEjemplos de Código
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.run/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="z-ai/glm-4.6",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
Benchmarks
Z.ai: GLM-4.6 obtiene 1425 en la categoría general del ranking de texto de LMArena (control de estilo), ocupando el puesto 86 de 374 modelos según 35.623 votos de preferencia humana (actualizado el 2026-07-12).
| Categoría | Puntuación Arena | IC del 95% | Puesto | Votos |
|---|---|---|---|---|
| General | 1425 | 1421–1429 | N.º 86 de 374 | 35.623 |
| Prompts difíciles | 1442 | 1437–1447 | N.º 93 de 374 | 19.079 |
| Programación | 1459 | 1452–1466 | N.º 107 de 369 | 7478 |
| Matemáticas | 1421 | 1408–1433 | N.º 91 de 362 | 2107 |
| Escritura creativa | 1402 | 1394–1411 | N.º 77 de 372 | 5087 |
| Seguimiento de instrucciones | 1415 | 1409–1422 | N.º 89 de 374 | 10.002 |
| Chino | 1482 | 1468–1497 | N.º 62 de 344 | 1649 |
Fuente: LMArena · CC BY 4.0 · Actualizado el 2026-07-12 · Metodología ↗ · Los puestos comparan modelos dentro de cada categoría del ranking de texto de LMArena (control de estilo). Las puntuaciones provienen de evaluaciones de preferencia humana de terceros, no de OFOX.