Grok 4.20 est le tout dernier modèle phare de xAI, lancé le 2026-03-31, qui allie une vitesse à la pointe du secteur à un appel d'outils agentique. Il associe un taux d'hallucination très faible à un respect strict du prompt, pour des réponses systématiquement précises et fiables. Ses capacités comprennent la vision (entrée d'images), l'appel d'outils (function calling), la mise en cache des prompts et la recherche web, couvrant l'ensemble des charges agentiques et multimodales. Fenêtre de contexte : 2M tokens, sortie : 128K. Tarifs : $4/M tokens en entrée et $12/M en sortie, lecture en cache à $0.40/M. Accessible via le protocole compatible OpenAI sur Ofox.
Providers
/v1/chat/completions/v1/responsesExemples de code
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.run/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="x-ai/grok-4.20",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
Benchmarks
xAI: Grok 4.20 obtient 1474 dans la catégorie générale du classement texte LMArena (contrôle de style), se classant 19e sur 374 modèles sur la base de 26 877 votes de préférence humaine (mis à jour le 2026-07-12).
| Catégorie | Score Arena | IC à 95 % | Rang | Votes |
|---|---|---|---|---|
| Général | 1474 | 1470–1479 | 19e sur 374 | 26 877 |
| Prompts difficiles | 1486 | 1481–1492 | 34e sur 374 | 16 695 |
| Programmation | 1508 | 1500–1516 | 39e sur 369 | 7 220 |
| Mathématiques | 1451 | 1436–1466 | 47e sur 362 | 1 604 |
| Écriture créative | 1460 | 1450–1470 | 16e sur 372 | 3 996 |
| Suivi d'instructions | 1449 | 1442–1456 | 43e sur 374 | 8 388 |
| Chinois | 1513 | 1496–1530 | 21e sur 344 | 1 392 |
Source : LMArena · CC BY 4.0 · Mis à jour le 2026-07-12 · Méthodologie ↗ · Les rangs comparent les modèles au sein de chaque catégorie du classement texte LMArena (contrôle de style). Les scores proviennent d'évaluations de préférence humaine tierces, et non d'OFOX.