Qwen: Qwen3.8 Flash

Chat
qwen/qwen3.8-flash

Qwen3.8 Flash est le modèle nativement multimodal léger et rapide de la série Qwen3.8 d'Alibaba Cloud Bailian, sorti le 2026-08-25. Il gère la compréhension d'images et de vidéos et prend en charge un raisonnement approfondi (reasoning_content) activable requête par requête, en visant les charges à forte concurrence et à faible coût sans renoncer aux tâches de code et de bureautique. Il prend aussi en charge l'appel d'outils, la mise en cache des prompts et la recherche web. Fenêtre de contexte : 1.13M tokens, sortie : 131K. Pouvoir désactiver le raisonnement appel par appel permet d'enchaîner des tours rapides et peu coûteux et de réserver la réflexion aux requêtes qui en ont besoin. Disponible via les protocoles compatible OpenAI et Anthropic chez Ofox.

Fenêtre de contexte
1M
Tokens de sortie max
131K
Publié
2026-08-25
Capacités
VisionFunction CallingRaisonnementPrompt CachingRecherche webEntrée vidéo
Fournisseurs disponibles
Aliyunalicloud
Protocoles supportés
openaianthropic

Providers

alicloud
Tokens d'entrée
$0.11/M
Tokens de sortie
$0.39/M
Lecture cache
$0.011/M
Écriture cache
$0.14/M
Recherche web
$0.01/R
Protocols
openai/v1/chat/completions/v1/responses
anthropic
Aliyun
Tokens d'entrée
$0.11/M
Tokens de sortie
$0.39/M
Lecture cache
$0.011/M
Écriture cache
$0.14/M
Recherche web
$0.01/R
Protocols
openai/v1/chat/completions/v1/responses
anthropic

Exemples de code

from openai import OpenAI
client = OpenAI(
base_url="https://api.ofox.run/v1",
api_key="YOUR_OFOX_API_KEY",
)
response = client.chat.completions.create(
model="qwen/qwen3.8-flash",
messages=[
{"role": "user", "content": "Hello!"}
],
)
print(response.choices[0].message.content)

Disponibilité et état

Questions fréquentes

Qwen: Qwen3.8 Flash sur Ofox.ai coûte $0.11/M par million de tokens d'entrée et $0.39/M par million de tokens de sortie. Paiement à l'usage, sans frais mensuels.