MoonshotAI: Kimi K2.5
Chatmoonshotai/kimi-k2.5Kimi K2.5 ist das nativ multimodale Modell von Moonshot AI, aufgebaut auf Kimi K2 mit fortgesetztem Pretraining über rund 15T gemischte visuelle und textuelle Tokens. Es bietet Spitzenleistung beim visuellen Programmieren sowie ein Paradigma selbstgesteuerter Agentenschwärme (Agent Swarm) und überzeugt bei allgemeinem Reasoning und agentischen Werkzeugaufrufen. Zu den Fähigkeiten zählen Bildverarbeitung, Videoeingabe, Reasoning, Werkzeugaufrufe, Prompt-Caching und Websuche, sodass es Bildschirme, Diagramme und Clips erfassen und anschließend über Werkzeuge darauf reagieren kann. Kontext und Ausgabe erreichen jeweils 262K tokens; die Eingabe kostet $0.60/M tokens, Cache-Lesevorgänge $0.10/M, und die Websuche wird separat abgerechnet. Veröffentlicht am 2026-01-27. Verfügbar über die Protokolle OpenAI und Anthropic bei Ofox.
Providers
/v1/chat/completionsCode-Beispiele
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.run/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="moonshotai/kimi-k2.5",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
Verfügbarkeit & Status
Benchmarks
MoonshotAI: Kimi K2.5 erreicht 1432 in der Gesamtkategorie des LMArena-Text-Leaderboards (Style Control) und belegt Platz 78 von 374 Modellen, basierend auf 8.181 menschlichen Präferenzstimmen (aktualisiert am 2026-07-12).
| Kategorie | Arena-Score | 95%-KI | Platz | Stimmen |
|---|---|---|---|---|
| Gesamt | 1432 | 1425–1438 | Platz 78 von 374 | 8.181 |
| Schwierige Prompts | 1461 | 1452–1469 | Platz 64 von 374 | 4.538 |
| Programmierung | 1504 | 1490–1518 | Platz 44 von 369 | 1.805 |
| Mathematik | 1441 | 1417–1466 | Platz 58 von 362 | 513 |
| Kreatives Schreiben | 1390 | 1373–1406 | Platz 100 von 372 | 1.273 |
| Anweisungsbefolgung | 1435 | 1423–1447 | Platz 60 von 374 | 2.231 |
| Chinesisch | 1472 | 1434–1509 | Platz 75 von 344 | 242 |
Quelle: LMArena · CC BY 4.0 · Aktualisiert am 2026-07-12 · Methodik ↗ · Die Platzierungen vergleichen Modelle innerhalb der jeweiligen Kategorie des LMArena-Text-Leaderboards (Style Control). Die Ergebnisse stammen aus menschlichen Präferenzbewertungen Dritter, nicht von OFOX.