O GLM-5V-Turbo é o primeiro modelo de base multimodal de programação da Z.ai, criado para tarefas de codificação baseadas em visão. Ele processa nativamente entradas multimodais como imagens, vídeo, PDF e texto, e também se destaca em planejamento de longo prazo, codificação complexa e execução de ações. Suas capacidades incluem visão, entrada de vídeo, entrada de PDF, raciocínio, chamada de funções (uso de ferramentas), cache de prompts e busca na web. Janela de contexto: 200K tokens, saída: 128K. Disponível pelos protocolos OpenAI e Anthropic na Ofox.
Providers
/v1/chat/completionsExemplos de Código
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.run/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="z-ai/glm-5v-turbo",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
Benchmarks
GLM-5V-Turbo obtém 1441 na categoria geral do ranking de texto do LMArena (controle de estilo), ficando em 66º de 374 modelos com base em 4.147 votos de preferência humana (atualizado em 2026-07-12).
| Categoria | Pontuação Arena | IC de 95% | Posição | Votos |
|---|---|---|---|---|
| Geral | 1441 | 1431–1450 | 66º de 374 | 4.147 |
| Prompts difíceis | 1459 | 1448–1471 | 67º de 374 | 2.656 |
| Programação | 1501 | 1483–1519 | 49º de 369 | 1.164 |
| Matemática | 1437 | 1397–1477 | 67º de 362 | 191 |
| Escrita criativa | 1396 | 1373–1419 | 84º de 372 | 714 |
| Seguimento de instruções | 1427 | 1411–1443 | 73º de 374 | 1.379 |
| Chinês | 1496 | 1455–1537 | 43º de 344 | 200 |
Fonte: LMArena · CC BY 4.0 · Atualizado em 2026-07-12 · Metodologia ↗ · As posições comparam modelos dentro de cada categoria do ranking de texto do LMArena (controle de estilo). As pontuações vêm de avaliações de preferência humana de terceiros, não da OFOX.