DeepSeek V4 Flash 0423

Chat
deepseek/deepseek-v4-flash-0423

DeepSeek V4 Flash 0423 est l'instantané daté du 2026-04-23 du modèle Mixture-of-Experts optimisé pour l'efficacité de DeepSeek, avec 284B de paramètres au total et 13B activés. Il vise l'inférence rapide et les charges à haut débit tout en restant capable sur les tâches de code et d'analyse. Il prend en charge l'appel d'outils et la mise en cache des prompts ; il n'expose pas de mode réflexion distinct. Fenêtre de contexte : 1M tokens, sortie : 384K. Gardez cet instantané plus ancien épinglé lorsqu'un déploiement a été validé dessus et que le comportement doit rester figé ; l'instantané 0731 est le point plus récent de la même lignée. Disponible via les protocoles compatible OpenAI et Anthropic chez Ofox.

Fenêtre de contexte
1M
Tokens de sortie max
384K
Publié
2026-04-23
Capacités
Function CallingPrompt Caching
Fournisseurs disponibles
Azure
Protocoles supportés
openaianthropic

Providers

Azure
Tokens d'entrée
$0.19/M
Tokens de sortie
$0.51/M
Lecture cache
$0.44/M
Recherche web
$0.035/R
Protocols
openai/v1/chat/completions/v1/responses
anthropic

Exemples de code

from openai import OpenAI
client = OpenAI(
base_url="https://api.ofox.run/v1",
api_key="YOUR_OFOX_API_KEY",
)
response = client.chat.completions.create(
model="deepseek/deepseek-v4-flash-0423",
messages=[
{"role": "user", "content": "Hello!"}
],
)
print(response.choices[0].message.content)

Questions fréquentes

DeepSeek V4 Flash 0423 sur Ofox.ai coûte $0.19/M par million de tokens d'entrée et $0.51/M par million de tokens de sortie. Paiement à l'usage, sans frais mensuels.