O GLM-4.7 é o modelo GLM principal da Z.ai, lançado em 23 de dezembro de 2025 e construído em torno de raciocínio avançado e de uma compreensão do chinês de primeira linha. Ele oferece raciocínio, chamada de funções (uso de ferramentas), cache de prompts e busca na web. Janela de contexto: 200K tokens, saída: 128K. O preço é de $0.40/M tokens de entrada e $2.00/M de saída, com leitura de cache a $0.08/M. Disponível pelos protocolos OpenAI e Anthropic na Ofox.
Providers
/v1/chat/completions/v1/chat/completionsExemplos de Código
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.run/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="z-ai/glm-4.7",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
Benchmarks
Z.ai: GLM 4.7 obtém 1443 na categoria geral do ranking de texto do LMArena (controle de estilo), ficando em 64º de 374 modelos com base em 12.095 votos de preferência humana (atualizado em 2026-07-12).
| Categoria | Pontuação Arena | IC de 95% | Posição | Votos |
|---|---|---|---|---|
| Geral | 1436–1449 | 64º de 374 | 12.095 | |
| Prompts difíceis | 1455–1471 | 61º de 374 | 6.602 | |
| Programação | 1474–1498 | 70º de 369 | 2.411 | |
| Matemática | 1407–1449 | 80º de 362 | 707 | |
| Escrita criativa | 1392–1419 | 72º de 372 | 1.917 | |
| Seguimento de instruções | 1418–1438 | 67º de 374 | 3.209 | |
| Chinês | 1465–1509 | 57º de 344 | 683 |
Fonte: LMArena · CC BY 4.0 · Atualizado em 2026-07-12 · Metodologia ↗ · As posições comparam modelos dentro de cada categoria do ranking de texto do LMArena (controle de estilo). As pontuações vêm de avaliações de preferência humana de terceiros, não da OFOX.