GLM-4.6 est le modèle de chat de la série GLM de Z.ai, sorti le 30 septembre 2025, doté d'un solide respect des instructions et d'un excellent équilibre entre performances et coût, en particulier sur les tâches en chinois. Il prend en charge le raisonnement, l'appel de fonctions (utilisation d'outils), la mise en cache des prompts et la recherche web. Fenêtre de contexte : 200K tokens, sortie : 128K. Les tarifs sont de $0.40/M tokens en entrée et $1.90/M en sortie, la lecture du cache étant facturée $0.11/M. Disponible via les protocoles OpenAI et Anthropic.
Providers
/v1/chat/completionsExemples de code
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.run/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="z-ai/glm-4.6",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
Benchmarks
Z.ai: GLM-4.6 obtient 1425 dans la catégorie générale du classement texte LMArena (contrôle de style), se classant 86e sur 374 modèles sur la base de 35 623 votes de préférence humaine (mis à jour le 2026-07-12).
| Catégorie | Score Arena | IC à 95 % | Rang | Votes |
|---|---|---|---|---|
| Général | 1425 | 1421–1429 | 86e sur 374 | 35 623 |
| Prompts difficiles | 1442 | 1437–1447 | 93e sur 374 | 19 079 |
| Programmation | 1459 | 1452–1466 | 107e sur 369 | 7 478 |
| Mathématiques | 1421 | 1408–1433 | 91e sur 362 | 2 107 |
| Écriture créative | 1402 | 1394–1411 | 77e sur 372 | 5 087 |
| Suivi d'instructions | 1415 | 1409–1422 | 89e sur 374 | 10 002 |
| Chinois | 1482 | 1468–1497 | 62e sur 344 | 1 649 |
Source : LMArena · CC BY 4.0 · Mis à jour le 2026-07-12 · Méthodologie ↗ · Les rangs comparent les modèles au sein de chaque catégorie du classement texte LMArena (contrôle de style). Les scores proviennent d'évaluations de préférence humaine tierces, et non d'OFOX.