MiniMax: MiniMax M2.5
Chatminimax/minimax-m2.5MiniMax M2.5 ist das hochmoderne große Sprachmodell von MiniMax für Produktivität im Arbeitsalltag. Trainiert in vielfältigen, komplexen digitalen Arbeitsumgebungen, baut es auf der Coding-Expertise von M2.1 auf und erweitert sie auf allgemeine Büroarbeit: Es erstellt und bearbeitet Word-, Excel- und PowerPoint-Dateien, wechselt den Kontext zwischen unterschiedlichen Softwareumgebungen und arbeitet über Agenten- und Menschen-Teams hinweg. Es erreicht 80,2 % auf SWE-Bench Verified, 51,3 % auf Multi-SWE-Bench und 76,3 % auf BrowseComp und ist token-effizienter als frühere Generationen, weil es darauf trainiert wurde, Aktionen und Ausgabe zu planen. Unterstützt werden Reasoning, Function Calling, Prompt-Caching und Websuche. Kontextfenster: 200K Tokens, Ausgabe: 131K. Verfügbar über die Protokolle OpenAI und Anthropic.
Providers
/v1/chat/completionsCode-Beispiele
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.run/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="minimax/minimax-m2.5",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
Benchmarks
MiniMax: MiniMax M2.5 erreicht 1391 in der Gesamtkategorie des LMArena-Text-Leaderboards (Style Control) und belegt Platz 137 von 374 Modellen, basierend auf 41.159 menschlichen Präferenzstimmen (aktualisiert am 2026-07-12).
| Kategorie | Arena-Score | 95%-KI | Platz | Stimmen |
|---|---|---|---|---|
| Gesamt | 1391 | 1387–1395 | Platz 137 von 374 | 41.159 |
| Schwierige Prompts | 1416 | 1411–1420 | Platz 133 von 374 | 25.585 |
| Programmierung | 1444 | 1438–1451 | Platz 126 von 369 | 10.895 |
| Mathematik | 1396 | 1384–1408 | Platz 132 von 362 | 2.436 |
| Kreatives Schreiben | 1359 | 1350–1367 | Platz 135 von 372 | 6.411 |
| Anweisungsbefolgung | 1381 | 1375–1387 | Platz 140 von 374 | 12.998 |
| Chinesisch | 1429 | 1416–1443 | Platz 125 von 344 | 2.187 |
Quelle: LMArena · CC BY 4.0 · Aktualisiert am 2026-07-12 · Methodik ↗ · Die Platzierungen vergleichen Modelle innerhalb der jeweiligen Kategorie des LMArena-Text-Leaderboards (Style Control). Die Ergebnisse stammen aus menschlichen Präferenzbewertungen Dritter, nicht von OFOX.