MiniMax M2.5 est le modèle de langage à l'état de l'art de MiniMax, conçu pour la productivité en conditions réelles. Entraîné dans des environnements de travail numériques variés et complexes, il s'appuie sur l'expertise en codage de M2.1 et l'étend au travail de bureau : générer et manipuler des fichiers Word, Excel et PowerPoint, changer de contexte entre différents environnements logiciels et collaborer avec des équipes d'agents comme avec des équipes humaines. Il obtient 80,2 % sur SWE-Bench Verified, 51,3 % sur Multi-SWE-Bench et 76,3 % sur BrowseComp, et consomme moins de tokens que les générations précédentes car il a été entraîné à planifier ses actions et sa sortie. Il prend en charge le raisonnement, l'appel de fonctions, la mise en cache des prompts et la recherche web. Fenêtre de contexte : 200K tokens, sortie : 131K. Disponible via les protocoles OpenAI et Anthropic.
Providers
/v1/chat/completionsExemples de code
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.run/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="minimax/minimax-m2.5",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
Benchmarks
MiniMax: MiniMax M2.5 obtient 1391 dans la catégorie générale du classement texte LMArena (contrôle de style), se classant 137e sur 374 modèles sur la base de 41 159 votes de préférence humaine (mis à jour le 2026-07-12).
| Catégorie | Score Arena | IC à 95 % | Rang | Votes |
|---|---|---|---|---|
| Général | 1391 | 1387–1395 | 137e sur 374 | 41 159 |
| Prompts difficiles | 1416 | 1411–1420 | 133e sur 374 | 25 585 |
| Programmation | 1444 | 1438–1451 | 126e sur 369 | 10 895 |
| Mathématiques | 1396 | 1384–1408 | 132e sur 362 | 2 436 |
| Écriture créative | 1359 | 1350–1367 | 135e sur 372 | 6 411 |
| Suivi d'instructions | 1381 | 1375–1387 | 140e sur 374 | 12 998 |
| Chinois | 1429 | 1416–1443 | 125e sur 344 | 2 187 |
Source : LMArena · CC BY 4.0 · Mis à jour le 2026-07-12 · Méthodologie ↗ · Les rangs comparent les modèles au sein de chaque catégorie du classement texte LMArena (contrôle de style). Les scores proviennent d'évaluations de préférence humaine tierces, et non d'OFOX.