Kimi K2.5 est le modèle multimodal natif de Moonshot AI, construit sur Kimi K2 avec un préentraînement prolongé sur environ 15T tokens mêlant image et texte. Il offre une capacité de programmation visuelle à l'état de l'art et un paradigme d'essaim d'agents autonomes (agent swarm), avec un raisonnement général solide et des appels d'outils agentiques. Ses capacités couvrent la vision, l'entrée vidéo, le raisonnement, l'utilisation d'outils, la mise en cache des prompts et la recherche web : il peut ainsi lire des écrans, des schémas et des clips, puis agir dessus via des outils. Le contexte et la sortie atteignent tous deux 262K tokens ; l'entrée est facturée $0.60/M tokens, les lectures de cache $0.10/M, et la recherche web est facturée séparément. Publié le 2026-01-27. Disponible via les protocoles OpenAI et Anthropic dans Ofox.
Providers
/v1/chat/completionsExemples de code
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.run/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="moonshotai/kimi-k2.5",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
Disponibilité et état
Benchmarks
MoonshotAI: Kimi K2.5 obtient 1432 dans la catégorie générale du classement texte LMArena (contrôle de style), se classant 78e sur 374 modèles sur la base de 8 181 votes de préférence humaine (mis à jour le 2026-07-12).
| Catégorie | Score Arena | IC à 95 % | Rang | Votes |
|---|---|---|---|---|
| Général | 1432 | 1425–1438 | 78e sur 374 | 8 181 |
| Prompts difficiles | 1461 | 1452–1469 | 64e sur 374 | 4 538 |
| Programmation | 1504 | 1490–1518 | 44e sur 369 | 1 805 |
| Mathématiques | 1441 | 1417–1466 | 58e sur 362 | 513 |
| Écriture créative | 1390 | 1373–1406 | 100e sur 372 | 1 273 |
| Suivi d'instructions | 1435 | 1423–1447 | 60e sur 374 | 2 231 |
| Chinois | 1472 | 1434–1509 | 75e sur 344 | 242 |
Source : LMArena · CC BY 4.0 · Mis à jour le 2026-07-12 · Méthodologie ↗ · Les rangs comparent les modèles au sein de chaque catégorie du classement texte LMArena (contrôle de style). Les scores proviennent d'évaluations de préférence humaine tierces, et non d'OFOX.