DeepSeek V4 Flash 0423

Chat
deepseek/deepseek-v4-flash-0423

DeepSeek V4 Flash 0423 ist der datierte Snapshot vom 2026-04-23 des effizienzoptimierten Mixture-of-Experts-Modells von DeepSeek mit 284B Gesamtparametern und 13B aktivierten Parametern. Es zielt auf schnelle Inferenz und durchsatzstarke Workloads und bleibt dabei bei Coding- und Analyseaufgaben leistungsfähig. Unterstützt Werkzeugaufrufe und Prompt Caching; einen separaten Thinking-Modus bietet es nicht. Kontextfenster: 1M Tokens, Output: 384K. Behalten Sie diesen älteren Snapshot fixiert, wenn ein Deployment dagegen validiert wurde und das Verhalten eingefroren bleiben soll; der Snapshot 0731 ist der neuere Punkt derselben Linie. Verfügbar über OpenAI- und Anthropic-Protocol über Ofox.

Kontextfenster
1M
Max. Ausgabe-Tokens
384K
Veröffentlicht
2026-04-23
Fähigkeiten
Function CallingPrompt Caching
Verfügbare Anbieter
Azure
Unterstützte Protokolle
openaianthropic

Providers

Azure
Eingabe-Tokens
$0.19/M
Ausgabe-Tokens
$0.51/M
Cache-Lesen
$0.44/M
Websuche
$0.035/R
Protocols
openai/v1/chat/completions/v1/responses
anthropic

Code-Beispiele

from openai import OpenAI
client = OpenAI(
base_url="https://api.ofox.run/v1",
api_key="YOUR_OFOX_API_KEY",
)
response = client.chat.completions.create(
model="deepseek/deepseek-v4-flash-0423",
messages=[
{"role": "user", "content": "Hello!"}
],
)
print(response.choices[0].message.content)

Häufig gestellte Fragen

DeepSeek V4 Flash 0423 auf Ofox.ai kostet $0.19/M pro Million Eingabe-Tokens und $0.51/M pro Million Ausgabe-Tokens. Pay-as-you-go, keine monatlichen Gebühren.