GLM-4.7 est le modèle GLM phare de Z.ai, sorti le 23 décembre 2025 et conçu autour d'un raisonnement avancé et d'une compréhension du chinois parmi les meilleures de sa catégorie. Il prend en charge le raisonnement, l'appel de fonctions (utilisation d'outils), la mise en cache des prompts et la recherche web. Fenêtre de contexte : 200K tokens, sortie : 128K. Les tarifs sont de $0.40/M tokens en entrée et $2.00/M en sortie, la lecture du cache étant facturée $0.08/M. Disponible via les protocoles OpenAI et Anthropic sur Ofox.
Providers
/v1/chat/completions/v1/chat/completionsExemples de code
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.run/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="z-ai/glm-4.7",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
Benchmarks
Z.ai: GLM 4.7 obtient 1443 dans la catégorie générale du classement texte LMArena (contrôle de style), se classant 64e sur 374 modèles sur la base de 12 095 votes de préférence humaine (mis à jour le 2026-07-12).
| Catégorie | Score Arena | IC à 95 % | Rang | Votes |
|---|---|---|---|---|
| Général | 1436–1449 | 64e sur 374 | 12 095 | |
| Prompts difficiles | 1455–1471 | 61e sur 374 | 6 602 | |
| Programmation | 1474–1498 | 70e sur 369 | 2 411 | |
| Mathématiques | 1407–1449 | 80e sur 362 | 707 | |
| Écriture créative | 1392–1419 | 72e sur 372 | 1 917 | |
| Suivi d'instructions | 1418–1438 | 67e sur 374 | 3 209 | |
| Chinois | 1465–1509 | 57e sur 344 | 683 |
Source : LMArena · CC BY 4.0 · Mis à jour le 2026-07-12 · Méthodologie ↗ · Les rangs comparent les modèles au sein de chaque catégorie du classement texte LMArena (contrôle de style). Les scores proviennent d'évaluations de préférence humaine tierces, et non d'OFOX.