Qwen: Qwen3.8 Max

Chat
qwen/qwen3.8-max

Qwen3.8 Max est le modèle phare de la série Qwen3.8 d'Alibaba Cloud Bailian, sorti le 3 août 2026, avec une fenêtre de contexte de 1M tokens et une sortie de 131K. Il prend en charge le raisonnement approfondi (reasoning_content) avec des chaînes de pensée plus longues, ainsi qu'une solide capacité de codage et une exécution autonome sur le long terme. Disponible via les protocoles compatible OpenAI et Anthropic chez Ofox.

Fenêtre de contexte
1M
Tokens de sortie max
131K
Publié
2026-08-03
Capacités
VisionFunction CallingRaisonnementPrompt CachingRecherche webEntrée vidéo
Fournisseurs disponibles
Aliyunalicloud
Protocoles supportés
openaianthropic

Providers

alicloud
Tokens d'entrée
$1.71/M
Tokens de sortie
$5.14/M
Lecture cache
$0.17/M
Écriture cache
$2.14/M
Recherche web
$0.01/R
Protocols
openai/v1/chat/completions/v1/responses
anthropic
Aliyun
Tokens d'entrée
$1.71/M
Tokens de sortie
$5.14/M
Lecture cache
$0.17/M
Écriture cache
$2.14/M
Recherche web
$0.01/R
Protocols
openai/v1/chat/completions/v1/responses
anthropic

Exemples de code

from openai import OpenAI
client = OpenAI(
base_url="https://api.ofox.run/v1",
api_key="YOUR_OFOX_API_KEY",
)
response = client.chat.completions.create(
model="qwen/qwen3.8-max",
messages=[
{"role": "user", "content": "Hello!"}
],
)
print(response.choices[0].message.content)

Disponibilité et état

Questions fréquentes

Qwen: Qwen3.8 Max sur Ofox.ai coûte $1.71/M par million de tokens d'entrée et $5.14/M par million de tokens de sortie. Paiement à l'usage, sans frais mensuels.