Qwen: Qwen3.8 Flash
Chatqwen/qwen3.8-flashQwen3.8 Flash ist das leichtgewichtige, schnelle und nativ multimodale Modell der Qwen3.8-Serie von Alibaba Cloud Bailian, veröffentlicht am 2026-08-25. Es beherrscht Bild- und Videoverständnis und unterstützt Deep Reasoning (reasoning_content), das pro Anfrage zuschaltbar ist, und zielt auf Workloads mit hoher Parallelität und niedrigen Kosten, ohne Coding- und Office-Aufgaben aufzugeben. Zusätzlich werden Werkzeugaufrufe, Prompt Caching und Websuche unterstützt. Kontextfenster: 1.13M Tokens, Output: 131K. Da sich Reasoning pro Aufruf abschalten lässt, können die meisten Anfragen schnell und günstig laufen und Thinking bleibt den Fällen vorbehalten, die es brauchen. Verfügbar über OpenAI- und Anthropic-Protocol über Ofox.
Kontextfenster
1M
Max. Ausgabe-Tokens
131K
Veröffentlicht
2026-08-25
Fähigkeiten
VisionFunction CallingReasoningPrompt CachingWebsucheVideo-Eingabe
Verfügbare Anbieter
alicloudAliyun
Unterstützte Protokolle
openaianthropic
Providers
alicloud
Eingabe-Tokens
$0.11/M
Ausgabe-Tokens
$0.39/M
Cache-Lesen
$0.011/M
Cache-Schreiben
$0.14/M
Websuche
$0.01/R
Protocols
openai
/v1/chat/completions/v1/responsesanthropic
Aliyun
Eingabe-Tokens
$0.11/M
Ausgabe-Tokens
$0.39/M
Cache-Lesen
$0.011/M
Cache-Schreiben
$0.14/M
Websuche
$0.01/R
Protocols
openai
/v1/chat/completions/v1/responsesanthropic
Code-Beispiele
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.run/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="qwen/qwen3.8-flash",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
Verfügbarkeit & Status
Verwandte Modelle
Häufig gestellte Fragen
Qwen: Qwen3.8 Flash auf Ofox.ai kostet $0.11/M pro Million Eingabe-Tokens und $0.39/M pro Million Ausgabe-Tokens. Pay-as-you-go, keine monatlichen Gebühren.
Qwen: Qwen3.8 Flash unterstützt ein Kontextfenster von 1M Tokens mit max. Ausgabe von 131K Tokens, was die Verarbeitung großer Dokumente und lange Konversationen ermöglicht.
Einfach Ihre Base-URL auf https://api.ofox.run/v1 setzen und Ihren Ofox API Key verwenden. Die API ist OpenAI-kompatibel — einfach Base-URL und API Key in Ihrem bestehenden Code ändern.
Qwen: Qwen3.8 Flash unterstützt folgende Fähigkeiten: Vision, Function Calling, Reasoning, Prompt Caching, Websuche, Video-Eingabe. Zugriff auf alle Features über die einheitliche Ofox.ai API.