Grok 4.1 Fast est la déclinaison rapide de Grok 4.1 signée xAI, lancée le 2025-11-19 : elle offre les meilleures performances agentiques de xAI sans raisonnement explicite, avec un appel d'outils amélioré. Elle prend en charge la vision (entrée d'images), l'appel d'outils (function calling), la mise en cache des prompts et la recherche web, ce qui en fait un bon choix pour les assistants outillés qui doivent répondre vite. Fenêtre de contexte : 2M tokens, sortie : 30K. Tarifs : $0.20/M tokens en entrée et $0.50/M en sortie, lecture en cache à $0.05/M, ce qui rend abordables les boucles d'agents à contexte long. Accessible via le protocole compatible OpenAI sur Ofox.
Providers
/v1/chat/completions/v1/responsesExemples de code
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.run/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="x-ai/grok-4.1-fast",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
Benchmarks
xAI: Grok 4.1 Fast obtient 1431 dans la catégorie générale du classement texte LMArena (contrôle de style), se classant 79e sur 374 modèles sur la base de 56 788 votes de préférence humaine (mis à jour le 2026-07-12).
| Catégorie | Score Arena | IC à 95 % | Rang | Votes |
|---|---|---|---|---|
| Général | 1431 | 1428–1434 | 79e sur 374 | 56 788 |
| Prompts difficiles | 1442 | 1437–1446 | 94e sur 374 | 32 700 |
| Programmation | 1462 | 1456–1467 | 101e sur 369 | 13 611 |
| Mathématiques | 1417 | 1407–1428 | 95e sur 362 | 3 501 |
| Écriture créative | 1413 | 1406–1420 | 61e sur 372 | 8 771 |
| Suivi d'instructions | 1402 | 1397–1407 | 109e sur 374 | 16 562 |
| Chinois | 1462 | 1450–1474 | 91e sur 344 | 2 902 |
Source : LMArena · CC BY 4.0 · Mis à jour le 2026-07-12 · Méthodologie ↗ · Les rangs comparent les modèles au sein de chaque catégorie du classement texte LMArena (contrôle de style). Les scores proviennent d'évaluations de préférence humaine tierces, et non d'OFOX.