DeepSeek V4 Flash 0423
Chatdeepseek/deepseek-v4-flash-0423DeepSeek V4 Flash 0423 est l'instantané daté du 2026-04-23 du modèle Mixture-of-Experts optimisé pour l'efficacité de DeepSeek, avec 284B de paramètres au total et 13B activés. Il vise l'inférence rapide et les charges à haut débit tout en restant capable sur les tâches de code et d'analyse. Il prend en charge l'appel d'outils et la mise en cache des prompts ; il n'expose pas de mode réflexion distinct. Fenêtre de contexte : 1M tokens, sortie : 384K. Gardez cet instantané plus ancien épinglé lorsqu'un déploiement a été validé dessus et que le comportement doit rester figé ; l'instantané 0731 est le point plus récent de la même lignée. Disponible via les protocoles compatible OpenAI et Anthropic chez Ofox.
Fenêtre de contexte
1M
Tokens de sortie max
384K
Publié
2026-04-23
Capacités
Function CallingPrompt Caching
Fournisseurs disponibles
Azure
Protocoles supportés
openaianthropic
Providers
Azure
Tokens d'entrée
$0.19/M
Tokens de sortie
$0.51/M
Lecture cache
$0.44/M
Recherche web
$0.035/R
Protocols
openai
/v1/chat/completions/v1/responsesanthropic
Exemples de code
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.run/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="deepseek/deepseek-v4-flash-0423",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
Modèles associés
Questions fréquentes
DeepSeek V4 Flash 0423 sur Ofox.ai coûte $0.19/M par million de tokens d'entrée et $0.51/M par million de tokens de sortie. Paiement à l'usage, sans frais mensuels.
DeepSeek V4 Flash 0423 supporte une fenêtre de contexte de 1M tokens avec un maximum de 384K tokens en sortie, permettant de traiter de longs documents et de maintenir des conversations prolongées.
Configurez simplement votre URL de base sur https://api.ofox.run/v1 et utilisez votre clé API Ofox. L'API est compatible OpenAI — changez simplement l'URL de base et la clé API dans votre code existant.
DeepSeek V4 Flash 0423 supporte les capacités suivantes : Function Calling, Prompt Caching. Accédez à toutes les fonctionnalités via l'API unifiée Ofox.ai.