GLM-5.2 é o modelo de raciocínio flagship da plataforma internacional da Z.ai (api.z.ai), construído sobre uma arquitetura MoE de pesos abertos com context window de 1M tokens. Incorpora thinking (reasoning_content), prompt caching, tool calling e busca na web, com forte desempenho em programação e execução agentic de longo horizonte. Disponível via protocolos OpenAI-compatible e Anthropic.
Providers
/v1/chat/completionsExemplos de Código
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.run/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="z-ai/glm-5.2",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
Disponibilidade e status
Benchmarks
Z.ai: GLM-5.2 obtém 1464 na categoria geral do ranking de texto do LMArena (controle de estilo), ficando em 35º de 374 modelos com base em 14.228 votos de preferência humana (atualizado em 2026-07-12).
| Categoria | Pontuação Arena | IC de 95% | Posição | Votos |
|---|---|---|---|---|
| Geral | 1464 | 1458–1471 | 35º de 374 | 14.228 |
| Prompts difíceis | 1487 | 1480–1494 | 32º de 374 | 9.331 |
| Programação | 1511 | 1501–1521 | 33º de 369 | 3.968 |
| Matemática | 1477 | 1455–1499 | 22º de 362 | 708 |
| Escrita criativa | 1443 | 1431–1455 | 38º de 372 | 2.561 |
| Seguimento de instruções | 1461 | 1452–1470 | 29º de 374 | 4.852 |
| Chinês | 1504 | 1481–1526 | 29º de 344 | 728 |
Fonte: LMArena · CC BY 4.0 · Atualizado em 2026-07-12 · Metodologia ↗ · As posições comparam modelos dentro de cada categoria do ranking de texto do LMArena (controle de estilo). As pontuações vêm de avaliações de preferência humana de terceiros, não da OFOX.