Claude Opus 4.6 es el modelo más potente de Anthropic para programación y tareas profesionales de larga duración, lanzado el 2026-02-05. Está diseñado para agentes que operan sobre flujos de trabajo completos en lugar de prompts aislados, por lo que resulta eficaz con bases de código grandes, refactorizaciones complejas y depuración de varios pasos, con una comprensión contextual más profunda y una mejor descomposición de problemas. Más allá del código, genera documentos, planes y análisis casi listos para producción en una sola pasada y mantiene la coherencia en salidas muy largas. Admite razonamiento, visión, uso de herramientas, entrada de PDF y caché de prompts. Ventana de contexto: 1M tokens, salida: 128K. Disponible mediante los protocolos OpenAI y Anthropic.
Providers
/v1/chat/completions/v1/responsesEjemplos de Código
import anthropicclient = anthropic.Anthropic(base_url="https://api.ofox.run/anthropic",api_key="YOUR_OFOX_API_KEY",)message = client.messages.create(model="anthropic/claude-opus-4.6",max_tokens=1024,messages=[{"role": "user", "content": "Hello!"}],)print(message.content[0].text)
Disponibilidad y estado
Benchmarks
Anthropic: Claude Opus 4.6 obtiene 1498 en la categoría general del ranking de texto de LMArena (control de estilo), ocupando el puesto 4 de 374 modelos según 63.487 votos de preferencia humana (actualizado el 2026-07-12).
| Categoría | Puntuación Arena | IC del 95% | Puesto | Votos |
|---|---|---|---|---|
| General | 1494–1501 | N.º 4 de 374 | 63.487 | |
| Prompts difíciles | 1523–1532 | N.º 3 de 374 | 40.530 | |
| Programación | 1542–1554 | N.º 5 de 369 | 17.517 | |
| Matemáticas | 1493–1514 | N.º 5 de 362 | 3537 | |
| Escritura creativa | 1471–1485 | N.º 7 de 372 | 10.341 | |
| Seguimiento de instrucciones | 1494–1505 | N.º 4 de 374 | 20.410 | |
| Chino | 1536–1559 | N.º 3 de 344 | 3242 |
Fuente: LMArena · CC BY 4.0 · Actualizado el 2026-07-12 · Metodología ↗ · Los puestos comparan modelos dentro de cada categoría del ranking de texto de LMArena (control de estilo). Las puntuaciones provienen de evaluaciones de preferencia humana de terceros, no de OFOX.