Qwen

Qwen3 Coder Flash

Chat
bailian/qwen3-coder-flash
VergleichenLoslegen

Qwen3-Coder-Flash ist Alibabas kosteneffizientes Coding-Modell auf Basis der Qwen3-Architektur. Es erbt die agentischen Coding-Fähigkeiten von Qwen3-Coder-Plus, unterstützt Multi-Turn-Tool-Interaktion und ist für Repository-Level-Code-Verständnis mit verbesserter Tool-Call-Stabilität optimiert. Context Window: 1M tokens, Output: 64K. Verfügbar über OpenAI- und Anthropic-Protocol.

Kontextfenster
1M
Max. Ausgabe-Tokens
64K
Veröffentlicht
2025-08-05
Fähigkeiten
Function CallingReasoningPrompt Caching
Verfügbare Anbieter
BaiLianAliyun
Unterstützte Protokolle
OpenAIopenaiAnthropicanthropic

Providers

BaiLianAliyun
Eingabe-Tokens
$0.5/M
Ausgabe-Tokens
$2.5/M
Cache-Lesen
$0.06/M
Cache-Schreiben
$0.27/M
Protocols
OpenAIopenai/v1/chat/completions/v1/responses
Anthropicanthropic

Code-Beispiele

from openai import OpenAI
client = OpenAI(
base_url="https://api.ofox.run/v1",
api_key="YOUR_OFOX_API_KEY",
)
response = client.chat.completions.create(
model="bailian/qwen3-coder-flash",
messages=[
{"role": "user", "content": "Hello!"}
],
)
print(response.choices[0].message.content)

Häufig gestellte Fragen

Qwen3 Coder Flash auf Ofox.ai kostet $0.5/M pro Million Eingabe-Tokens und $2.5/M pro Million Ausgabe-Tokens. Pay-as-you-go, keine monatlichen Gebühren.