Qwen: Qwen3.8 Flash

Chat
qwen/qwen3.8-flash

Qwen3.8 Flash es el modelo multimodal nativo ligero y de alta velocidad de la serie Qwen3.8 de Alibaba Cloud Bailian, lanzado el 2026-08-25. Maneja comprensión de imagen y vídeo y admite razonamiento profundo (reasoning_content) conmutable por petición, apuntando a cargas de alta concurrencia y bajo coste sin renunciar a tareas de programación y ofimática. También admite uso de herramientas, caché de prompts y búsqueda web. Ventana de contexto: 1.13M tokens, salida: 131K. Poder desactivar el razonamiento por llamada permite ejecutar turnos rápidos y baratos y reservar el pensamiento para las peticiones que lo necesitan. Disponible mediante los protocolos compatible con OpenAI y Anthropic a través de Ofox.

Ventana de Contexto
1M
Tokens de Salida Máximos
131K
Lanzamiento
2026-08-25
Capacidades
VisiónFunction CallingRazonamientoPrompt CachingBúsqueda WebEntrada de Video
Proveedores Disponibles
Aliyunalicloud
Protocolos Soportados
openaianthropic

Providers

alicloud
Tokens de Entrada
$0.11/M
Tokens de Salida
$0.39/M
Lectura de Caché
$0.011/M
Escritura de Caché
$0.14/M
Búsqueda Web
$0.01/R
Protocols
openai/v1/chat/completions/v1/responses
anthropic
Aliyun
Tokens de Entrada
$0.11/M
Tokens de Salida
$0.39/M
Lectura de Caché
$0.011/M
Escritura de Caché
$0.14/M
Búsqueda Web
$0.01/R
Protocols
openai/v1/chat/completions/v1/responses
anthropic

Ejemplos de Código

from openai import OpenAI
client = OpenAI(
base_url="https://api.ofox.run/v1",
api_key="YOUR_OFOX_API_KEY",
)
response = client.chat.completions.create(
model="qwen/qwen3.8-flash",
messages=[
{"role": "user", "content": "Hello!"}
],
)
print(response.choices[0].message.content)

Disponibilidad y estado

Preguntas Frecuentes

Qwen: Qwen3.8 Flash en Ofox.ai cuesta $0.11/M por millón de tokens de entrada y $0.39/M por millón de tokens de salida. Pago por uso, sin cuotas mensuales.