O GLM-4.6 é o modelo de chat da série GLM da Z.ai, lançado em 30 de setembro de 2025, com forte aderência a instruções e um excelente equilíbrio entre desempenho e custo, especialmente em tarefas em chinês. Ele oferece raciocínio, chamada de funções (uso de ferramentas), cache de prompts e busca na web. Janela de contexto: 200K tokens, saída: 128K. O preço é de $0.40/M tokens de entrada e $1.90/M de saída, com leitura de cache a $0.11/M. Disponível pelos protocolos OpenAI e Anthropic.
Providers
/v1/chat/completionsExemplos de Código
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.run/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="z-ai/glm-4.6",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
Benchmarks
Z.ai: GLM-4.6 obtém 1425 na categoria geral do ranking de texto do LMArena (controle de estilo), ficando em 86º de 374 modelos com base em 35.623 votos de preferência humana (atualizado em 2026-07-12).
| Categoria | Pontuação Arena | IC de 95% | Posição | Votos |
|---|---|---|---|---|
| Geral | 1425 | 1421–1429 | 86º de 374 | 35.623 |
| Prompts difíceis | 1442 | 1437–1447 | 93º de 374 | 19.079 |
| Programação | 1459 | 1452–1466 | 107º de 369 | 7.478 |
| Matemática | 1421 | 1408–1433 | 91º de 362 | 2.107 |
| Escrita criativa | 1402 | 1394–1411 | 77º de 372 | 5.087 |
| Seguimento de instruções | 1415 | 1409–1422 | 89º de 374 | 10.002 |
| Chinês | 1482 | 1468–1497 | 62º de 344 | 1.649 |
Fonte: LMArena · CC BY 4.0 · Atualizado em 2026-07-12 · Metodologia ↗ · As posições comparam modelos dentro de cada categoria do ranking de texto do LMArena (controle de estilo). As pontuações vêm de avaliações de preferência humana de terceiros, não da OFOX.