Qwen: Qwen3.8 Flash

Chat
qwen/qwen3.8-flash

O Qwen3.8 Flash é o modelo multimodal nativo leve e de alta velocidade da série Qwen3.8 da Alibaba Cloud Bailian, lançado em 2026-08-25. Lida com compreensão de imagem e vídeo e suporta raciocínio profundo (reasoning_content) alternável por requisição, mirando cargas de alta concorrência e baixo custo sem abrir mão de tarefas de programação e escritório. Também suporta uso de ferramentas, cache de prompts e busca na web. Janela de contexto: 1.13M tokens, saída: 131K. Poder desligar o raciocínio por chamada torna prático executar turnos rápidos e baratos e reservar o pensamento para as requisições que precisam dele. Disponível pelos protocolos compatíveis com OpenAI e Anthropic via Ofox.

Janela de Contexto
1M
Tokens Máx de Saída
131K
Lançamento
2026-08-25
Capacidades
VisãoFunction CallingRaciocínioPrompt CachingBusca WebEntrada de Vídeo
Provedores Disponíveis
Aliyunalicloud
Protocolos Suportados
openaianthropic

Providers

alicloud
Tokens de Entrada
$0.11/M
Tokens de Saída
$0.39/M
Leitura de Cache
$0.011/M
Escrita de Cache
$0.14/M
Busca Web
$0.01/R
Protocols
openai/v1/chat/completions/v1/responses
anthropic
Aliyun
Tokens de Entrada
$0.11/M
Tokens de Saída
$0.39/M
Leitura de Cache
$0.011/M
Escrita de Cache
$0.14/M
Busca Web
$0.01/R
Protocols
openai/v1/chat/completions/v1/responses
anthropic

Exemplos de Código

from openai import OpenAI
client = OpenAI(
base_url="https://api.ofox.run/v1",
api_key="YOUR_OFOX_API_KEY",
)
response = client.chat.completions.create(
model="qwen/qwen3.8-flash",
messages=[
{"role": "user", "content": "Hello!"}
],
)
print(response.choices[0].message.content)

Disponibilidade e status

Perguntas Frequentes

Qwen: Qwen3.8 Flash na Ofox.ai custa $0.11/M por milhão de tokens de entrada e $0.39/M por milhão de tokens de saída. Pague por uso, sem mensalidade.