MiniMax M2.5 es el modelo de lenguaje de última generación de MiniMax, diseñado para la productividad del mundo real. Entrenado en entornos de trabajo digitales diversos y complejos, parte de la experiencia en programación de M2.1 y la amplía al trabajo de oficina general: genera y opera archivos de Word, Excel y PowerPoint, cambia de contexto entre distintos entornos de software y colabora con equipos de agentes y de personas. Obtiene un 80,2% en SWE-Bench Verified, un 51,3% en Multi-SWE-Bench y un 76,3% en BrowseComp, y resulta más eficiente en tokens que las generaciones anteriores porque se entrenó para planificar sus acciones y su salida. Admite razonamiento, llamada a funciones, caché de prompts y búsqueda web. Ventana de contexto: 200K tokens, salida: 131K. Disponible a través de los protocolos OpenAI y Anthropic.
Providers
/v1/chat/completionsEjemplos de Código
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.run/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="minimax/minimax-m2.5",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
Benchmarks
MiniMax: MiniMax M2.5 obtiene 1391 en la categoría general del ranking de texto de LMArena (control de estilo), ocupando el puesto 137 de 374 modelos según 41.159 votos de preferencia humana (actualizado el 2026-07-12).
| Categoría | Puntuación Arena | IC del 95% | Puesto | Votos |
|---|---|---|---|---|
| General | 1391 | 1387–1395 | N.º 137 de 374 | 41.159 |
| Prompts difíciles | 1416 | 1411–1420 | N.º 133 de 374 | 25.585 |
| Programación | 1444 | 1438–1451 | N.º 126 de 369 | 10.895 |
| Matemáticas | 1396 | 1384–1408 | N.º 132 de 362 | 2436 |
| Escritura creativa | 1359 | 1350–1367 | N.º 135 de 372 | 6411 |
| Seguimiento de instrucciones | 1381 | 1375–1387 | N.º 140 de 374 | 12.998 |
| Chino | 1429 | 1416–1443 | N.º 125 de 344 | 2187 |
Fuente: LMArena · CC BY 4.0 · Actualizado el 2026-07-12 · Metodología ↗ · Los puestos comparan modelos dentro de cada categoría del ranking de texto de LMArena (control de estilo). Las puntuaciones provienen de evaluaciones de preferencia humana de terceros, no de OFOX.