DeepSeek V4 Flash 0731

Chat
deepseek/deepseek-v4-flash-0731

DeepSeek V4 Flash 0731 ist der datierte Snapshot vom 2026-07-31 des effizienzoptimierten Mixture-of-Experts-Modells von DeepSeek mit 284B Gesamtparametern und 13B aktivierten Parametern. Es ist auf schnelle Inferenz und durchsatzstarke Workloads ausgelegt und bleibt dabei stark bei Coding- und Analyseaufgaben. Unterstützt Werkzeugaufrufe und Prompt Caching; einen separaten Thinking-Modus bietet es nicht. Kontextfenster: 1M Tokens, Output: 384K. Die ungewöhnlich hohe Ausgabegrenze von 384K passt zu Aufgaben, die lange Artefakte in einer einzigen Antwort erzeugen — vollständige Datei-Rewrites, Massenübersetzung, generierte Berichte. Verfügbar über OpenAI- und Anthropic-Protocol über Ofox.

Kontextfenster
1M
Max. Ausgabe-Tokens
384K
Veröffentlicht
2026-07-31
Fähigkeiten
Function CallingPrompt Caching
Verfügbare Anbieter
Volcengine
Unterstützte Protokolle
openaianthropic

Providers

Volcengine
Eingabe-Tokens
$0.44/M
Ausgabe-Tokens
$1.32/M
Cache-Lesen
$0.014/M
Protocols
openai/v1/chat/completions/v1/responses
anthropic

Code-Beispiele

from openai import OpenAI
client = OpenAI(
base_url="https://api.ofox.run/v1",
api_key="YOUR_OFOX_API_KEY",
)
response = client.chat.completions.create(
model="deepseek/deepseek-v4-flash-0731",
messages=[
{"role": "user", "content": "Hello!"}
],
)
print(response.choices[0].message.content)

Häufig gestellte Fragen

DeepSeek V4 Flash 0731 auf Ofox.ai kostet $0.44/M pro Million Eingabe-Tokens und $1.32/M pro Million Ausgabe-Tokens. Pay-as-you-go, keine monatlichen Gebühren.