Qwen: Qwen3.8 Flash
Chatqwen/qwen3.8-flashQwen3.8 Flash est le modèle nativement multimodal léger et rapide de la série Qwen3.8 d'Alibaba Cloud Bailian, sorti le 2026-08-25. Il gère la compréhension d'images et de vidéos et prend en charge un raisonnement approfondi (reasoning_content) activable requête par requête, en visant les charges à forte concurrence et à faible coût sans renoncer aux tâches de code et de bureautique. Il prend aussi en charge l'appel d'outils, la mise en cache des prompts et la recherche web. Fenêtre de contexte : 1.13M tokens, sortie : 131K. Pouvoir désactiver le raisonnement appel par appel permet d'enchaîner des tours rapides et peu coûteux et de réserver la réflexion aux requêtes qui en ont besoin. Disponible via les protocoles compatible OpenAI et Anthropic chez Ofox.
Providers
/v1/chat/completions/v1/responses/v1/chat/completions/v1/responsesExemples de code
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.run/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="qwen/qwen3.8-flash",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)