GPT-4.1 es el modelo insignia de OpenAI de la generación anterior, publicado el 14 de abril de 2025 y optimizado para el seguimiento avanzado de instrucciones, la ingeniería de software real y el razonamiento con contextos largos. Su ventana de contexto de 1M tokens encaja en el análisis de documentos complejos y la generación de código a gran escala, y admite entrada de imágenes, uso de herramientas, caché de prompts y entrada de audio. Ventana de contexto: 1M tokens, salida: 32K. Los modelos más recientes de las series GPT-5 y Codex han asumido el trabajo de programación de vanguardia, pero GPT-4.1 sigue siendo una opción fiable y más económica para cargas con documentos largos e integraciones ya existentes. Accesible mediante el protocolo compatible con OpenAI.
Providers
/v1/chat/completions/v1/responsesEjemplos de Código
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.run/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="openai/gpt-4.1",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
Benchmarks
GPT-4.1 obtiene 1414 en la categoría general del ranking de texto de LMArena (control de estilo), ocupando el puesto 109 de 374 modelos según 50.934 votos de preferencia humana (actualizado el 2026-07-12).
| Categoría | Puntuación Arena | IC del 95% | Puesto | Votos |
|---|---|---|---|---|
| General | 1414 | 1410–1417 | N.º 109 de 374 | 50.934 |
| Prompts difíciles | 1431 | 1426–1436 | N.º 111 de 374 | 22.148 |
| Programación | 1456 | 1450–1463 | N.º 113 de 369 | 9308 |
| Matemáticas | 1373 | 1363–1383 | N.º 157 de 362 | 3222 |
| Escritura creativa | 1402 | 1395–1410 | N.º 78 de 372 | 6702 |
| Seguimiento de instrucciones | 1403 | 1397–1408 | N.º 107 de 374 | 13.281 |
| Chino | 1416 | 1403–1428 | N.º 133 de 344 | 2462 |
Fuente: LMArena · CC BY 4.0 · Actualizado el 2026-07-12 · Metodología ↗ · Los puestos comparan modelos dentro de cada categoría del ranking de texto de LMArena (control de estilo). Las puntuaciones provienen de evaluaciones de preferencia humana de terceros, no de OFOX.