Qwen: Qwen3.8 Flash
Chatqwen/qwen3.8-flashQwen3.8 Flash es el modelo multimodal nativo ligero y de alta velocidad de la serie Qwen3.8 de Alibaba Cloud Bailian, lanzado el 2026-08-25. Maneja comprensión de imagen y vídeo y admite razonamiento profundo (reasoning_content) conmutable por petición, apuntando a cargas de alta concurrencia y bajo coste sin renunciar a tareas de programación y ofimática. También admite uso de herramientas, caché de prompts y búsqueda web. Ventana de contexto: 1.13M tokens, salida: 131K. Poder desactivar el razonamiento por llamada permite ejecutar turnos rápidos y baratos y reservar el pensamiento para las peticiones que lo necesitan. Disponible mediante los protocolos compatible con OpenAI y Anthropic a través de Ofox.
Ventana de Contexto
1M
Tokens de Salida Máximos
131K
Lanzamiento
2026-08-25
Capacidades
VisiónFunction CallingRazonamientoPrompt CachingBúsqueda WebEntrada de Video
Proveedores Disponibles
Aliyunalicloud
Protocolos Soportados
openaianthropic
Providers
alicloud
Tokens de Entrada
$0.11/M
Tokens de Salida
$0.39/M
Lectura de Caché
$0.011/M
Escritura de Caché
$0.14/M
Búsqueda Web
$0.01/R
Protocols
openai
/v1/chat/completions/v1/responsesanthropic
Aliyun
Tokens de Entrada
$0.11/M
Tokens de Salida
$0.39/M
Lectura de Caché
$0.011/M
Escritura de Caché
$0.14/M
Búsqueda Web
$0.01/R
Protocols
openai
/v1/chat/completions/v1/responsesanthropic
Ejemplos de Código
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.run/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="qwen/qwen3.8-flash",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)
Disponibilidad y estado
Modelos Relacionados
Preguntas Frecuentes
Qwen: Qwen3.8 Flash en Ofox.ai cuesta $0.11/M por millón de tokens de entrada y $0.39/M por millón de tokens de salida. Pago por uso, sin cuotas mensuales.
Qwen: Qwen3.8 Flash soporta una ventana de contexto de 1M tokens con salida máxima de 131K tokens, permitiéndote procesar documentos extensos y mantener conversaciones largas.
Simplemente configura tu base URL a https://api.ofox.run/v1 y usa tu API key de Ofox. La API es compatible con OpenAI — solo cambia la base URL y la API key en tu código existente.
Qwen: Qwen3.8 Flash soporta las siguientes capacidades: Visión, Function Calling, Razonamiento, Prompt Caching, Búsqueda Web, Entrada de Video. Accede a todas las funciones a través de la API unificada de Ofox.ai.