GPT-4.1
Chatopenai/gpt-4.1GPT-4.1 ist das Flaggschiff-Modell von OpenAI aus der vorigen Generation, veröffentlicht am 14. April 2025 und optimiert für präzises Befolgen von Anweisungen, praxisnahe Softwareentwicklung und Reasoning über lange Kontexte. Das Kontextfenster von 1M Tokens eignet sich für die Analyse komplexer Dokumente und die Codegenerierung im großen Maßstab; unterstützt werden Bildeingabe, Werkzeugaufrufe, Prompt-Caching und Audioeingabe. Kontextfenster: 1M Tokens, Ausgabe: 32K. Neuere Modelle der GPT-5- und Codex-Reihe haben die Spitzenarbeit beim Programmieren übernommen, doch GPT-4.1 bleibt eine verlässliche und günstigere Wahl für lange Dokumente und bestehende Integrationen. Zugänglich über das OpenAI-kompatible Protokoll.
Providers
/v1/chat/completions/v1/responsesCode-Beispiele
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.run/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="openai/gpt-4.1",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
Benchmarks
GPT-4.1 erreicht 1414 in der Gesamtkategorie des LMArena-Text-Leaderboards (Style Control) und belegt Platz 109 von 374 Modellen, basierend auf 50.934 menschlichen Präferenzstimmen (aktualisiert am 2026-07-12).
| Kategorie | Arena-Score | 95%-KI | Platz | Stimmen |
|---|---|---|---|---|
| Gesamt | 1414 | 1410–1417 | Platz 109 von 374 | 50.934 |
| Schwierige Prompts | 1431 | 1426–1436 | Platz 111 von 374 | 22.148 |
| Programmierung | 1456 | 1450–1463 | Platz 113 von 369 | 9.308 |
| Mathematik | 1373 | 1363–1383 | Platz 157 von 362 | 3.222 |
| Kreatives Schreiben | 1402 | 1395–1410 | Platz 78 von 372 | 6.702 |
| Anweisungsbefolgung | 1403 | 1397–1408 | Platz 107 von 374 | 13.281 |
| Chinesisch | 1416 | 1403–1428 | Platz 133 von 344 | 2.462 |
Quelle: LMArena · CC BY 4.0 · Aktualisiert am 2026-07-12 · Methodik ↗ · Die Platzierungen vergleichen Modelle innerhalb der jeweiligen Kategorie des LMArena-Text-Leaderboards (Style Control). Die Ergebnisse stammen aus menschlichen Präferenzbewertungen Dritter, nicht von OFOX.