GPT-5.1 es la versión mejorada de GPT-5 que OpenAI lanzó el 2025-11-13, con mejor razonamiento, mayor fidelidad a las instrucciones y un rendimiento de programación más sólido. Acepta entrada de visión, audio y vídeo, además de razonamiento, uso de herramientas (function calling), caché de prompts y búsqueda web. Ventana de contexto: 256K tokens, salida: 128K, cuatro veces el límite de salida de GPT-5. Accesible mediante el protocolo compatible con OpenAI a través de Ofox.
Providers
/v1/chat/completions/v1/responsesEjemplos de Código
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.run/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="openai/gpt-5.1",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
Benchmarks
OpenAI: GPT-5.1 obtiene 1439 en la categoría general del ranking de texto de LMArena (control de estilo), ocupando el puesto 67 de 374 modelos según 43.424 votos de preferencia humana (actualizado el 2026-07-12).
| Categoría | Puntuación Arena | IC del 95% | Puesto | Votos |
|---|---|---|---|---|
| General | 1435–1442 | N.º 67 de 374 | 43.424 | |
| Prompts difíciles | 1450–1460 | N.º 77 de 374 | 23.571 | |
| Programación | 1467–1481 | N.º 84 de 369 | 9121 | |
| Matemáticas | 1412–1434 | N.º 90 de 362 | 2864 | |
| Escritura creativa | 1402–1418 | N.º 64 de 372 | 6428 | |
| Seguimiento de instrucciones | 1421–1433 | N.º 71 de 374 | 11.850 | |
| Chino | 1464–1491 | N.º 69 de 344 | 2028 |
Fuente: LMArena · CC BY 4.0 · Actualizado el 2026-07-12 · Metodología ↗ · Los puestos comparan modelos dentro de cada categoría del ranking de texto de LMArena (control de estilo). Las puntuaciones provienen de evaluaciones de preferencia humana de terceros, no de OFOX.