GLM-5V-Turbo es el primer modelo fundacional multimodal de programación de Z.ai, creado para tareas de codificación basadas en la visión. Procesa de forma nativa entradas multimodales como imágenes, vídeo, PDF y texto, y destaca además en planificación de largo alcance, codificación compleja y ejecución de acciones. Sus capacidades incluyen visión, entrada de vídeo, entrada de PDF, razonamiento, llamada de funciones (uso de herramientas), caché de prompts y búsqueda web. Ventana de contexto: 200K tokens, salida: 128K. Disponible a través de los protocolos OpenAI y Anthropic en Ofox.
Providers
/v1/chat/completionsEjemplos de Código
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.run/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="z-ai/glm-5v-turbo",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
Benchmarks
GLM-5V-Turbo obtiene 1441 en la categoría general del ranking de texto de LMArena (control de estilo), ocupando el puesto 66 de 374 modelos según 4147 votos de preferencia humana (actualizado el 2026-07-12).
| Categoría | Puntuación Arena | IC del 95% | Puesto | Votos |
|---|---|---|---|---|
| General | 1441 | 1431–1450 | N.º 66 de 374 | 4147 |
| Prompts difíciles | 1459 | 1448–1471 | N.º 67 de 374 | 2656 |
| Programación | 1501 | 1483–1519 | N.º 49 de 369 | 1164 |
| Matemáticas | 1437 | 1397–1477 | N.º 67 de 362 | 191 |
| Escritura creativa | 1396 | 1373–1419 | N.º 84 de 372 | 714 |
| Seguimiento de instrucciones | 1427 | 1411–1443 | N.º 73 de 374 | 1379 |
| Chino | 1496 | 1455–1537 | N.º 43 de 344 | 200 |
Fuente: LMArena · CC BY 4.0 · Actualizado el 2026-07-12 · Metodología ↗ · Los puestos comparan modelos dentro de cada categoría del ranking de texto de LMArena (control de estilo). Las puntuaciones provienen de evaluaciones de preferencia humana de terceros, no de OFOX.