Anthropic: Claude Opus 4.6
Chatanthropic/claude-opus-4.6Claude Opus 4.6 ist das stärkste Modell von Anthropic für Programmierung und langlaufende professionelle Aufgaben, veröffentlicht am 2026-02-05. Es ist für Agenten gebaut, die ganze Workflows statt einzelner Anfragen bearbeiten, und eignet sich damit für große Codebasen, komplexe Refactorings und mehrstufiges Debugging – mit tieferem Kontextverständnis und besserer Problemzerlegung. Über das Programmieren hinaus erstellt es in einem Durchgang nahezu produktionsreife Dokumente, Pläne und Analysen und bleibt auch bei sehr langen Ausgaben kohärent. Unterstützt Reasoning, Bildverarbeitung, Werkzeugnutzung, PDF-Eingabe und Prompt-Caching. Kontextfenster: 1M Tokens, Ausgabe: 128K. Verfügbar über die Protokolle OpenAI und Anthropic.
Providers
/v1/chat/completions/v1/responsesCode-Beispiele
import anthropicclient = anthropic.Anthropic(base_url="https://api.ofox.run/anthropic",api_key="YOUR_OFOX_API_KEY",)message = client.messages.create(model="anthropic/claude-opus-4.6",max_tokens=1024,messages=[{"role": "user", "content": "Hello!"}],)print(message.content[0].text)
Verfügbarkeit & Status
Benchmarks
Anthropic: Claude Opus 4.6 erreicht 1498 in der Gesamtkategorie des LMArena-Text-Leaderboards (Style Control) und belegt Platz 4 von 374 Modellen, basierend auf 63.487 menschlichen Präferenzstimmen (aktualisiert am 2026-07-12).
| Kategorie | Arena-Score | 95%-KI | Platz | Stimmen |
|---|---|---|---|---|
| Gesamt | 1494–1501 | Platz 4 von 374 | 63.487 | |
| Schwierige Prompts | 1523–1532 | Platz 3 von 374 | 40.530 | |
| Programmierung | 1542–1554 | Platz 5 von 369 | 17.517 | |
| Mathematik | 1493–1514 | Platz 5 von 362 | 3.537 | |
| Kreatives Schreiben | 1471–1485 | Platz 7 von 372 | 10.341 | |
| Anweisungsbefolgung | 1494–1505 | Platz 4 von 374 | 20.410 | |
| Chinesisch | 1536–1559 | Platz 3 von 344 | 3.242 |
Quelle: LMArena · CC BY 4.0 · Aktualisiert am 2026-07-12 · Methodik ↗ · Die Platzierungen vergleichen Modelle innerhalb der jeweiligen Kategorie des LMArena-Text-Leaderboards (Style Control). Die Ergebnisse stammen aus menschlichen Präferenzbewertungen Dritter, nicht von OFOX.