Qwen: Qwen3.8 Flash

Chat
qwen/qwen3.8-flash

Qwen3.8 Flash ist das leichtgewichtige, schnelle und nativ multimodale Modell der Qwen3.8-Serie von Alibaba Cloud Bailian, veröffentlicht am 2026-08-25. Es beherrscht Bild- und Videoverständnis und unterstützt Deep Reasoning (reasoning_content), das pro Anfrage zuschaltbar ist, und zielt auf Workloads mit hoher Parallelität und niedrigen Kosten, ohne Coding- und Office-Aufgaben aufzugeben. Zusätzlich werden Werkzeugaufrufe, Prompt Caching und Websuche unterstützt. Kontextfenster: 1.13M Tokens, Output: 131K. Da sich Reasoning pro Aufruf abschalten lässt, können die meisten Anfragen schnell und günstig laufen und Thinking bleibt den Fällen vorbehalten, die es brauchen. Verfügbar über OpenAI- und Anthropic-Protocol über Ofox.

Kontextfenster
1M
Max. Ausgabe-Tokens
131K
Veröffentlicht
2026-08-25
Fähigkeiten
VisionFunction CallingReasoningPrompt CachingWebsucheVideo-Eingabe
Verfügbare Anbieter
alicloudAliyun
Unterstützte Protokolle
openaianthropic

Providers

alicloud
Eingabe-Tokens
$0.11/M
Ausgabe-Tokens
$0.39/M
Cache-Lesen
$0.011/M
Cache-Schreiben
$0.14/M
Websuche
$0.01/R
Protocols
openai/v1/chat/completions/v1/responses
anthropic
Aliyun
Eingabe-Tokens
$0.11/M
Ausgabe-Tokens
$0.39/M
Cache-Lesen
$0.011/M
Cache-Schreiben
$0.14/M
Websuche
$0.01/R
Protocols
openai/v1/chat/completions/v1/responses
anthropic

Code-Beispiele

from openai import OpenAI
client = OpenAI(
base_url="https://api.ofox.run/v1",
api_key="YOUR_OFOX_API_KEY",
)
response = client.chat.completions.create(
model="qwen/qwen3.8-flash",
messages=[
{"role": "user", "content": "Hello!"}
],
)
print(response.choices[0].message.content)

Verfügbarkeit & Status

Häufig gestellte Fragen

Qwen: Qwen3.8 Flash auf Ofox.ai kostet $0.11/M pro Million Eingabe-Tokens und $0.39/M pro Million Ausgabe-Tokens. Pay-as-you-go, keine monatlichen Gebühren.