Qwen: Qwen3.8 Flash

Chat
qwen/qwen3.8-flash

Qwen3.8 Flash — лёгкая высокоскоростная нативно мультимодальная модель серии Qwen3.8 от Alibaba Cloud Bailian, выпущенная 2026-08-25. Она понимает изображения и видео и поддерживает глубокие рассуждения (reasoning_content), которые можно включать и выключать для каждого запроса, ориентируясь на высококонкурентные и недорогие нагрузки без потери качества в программировании и офисных задачах. Также поддерживаются вызов инструментов, кэширование промптов и веб-поиск. Контекстное окно: 1.13M токенов, вывод: 131K. Возможность отключать рассуждения на уровне вызова позволяет обрабатывать большинство запросов быстро и дёшево, включая размышление только там, где оно нужно. Доступна через OpenAI-совместимый и Anthropic протоколы в Ofox.

Контекстное окно
1M
Макс. выходных токенов
131K
Дата релиза
2026-08-25
Возможности
ЗрениеFunction CallingРассуждениеКэширование промптовВеб-поискВидео-вход
Доступные провайдеры
alicloudAliyun
Поддерживаемые протоколы
openaianthropic

Providers

alicloud
Входные токены
$0.11/M
Выходные токены
$0.39/M
Чтение кэша
$0.011/M
Запись кэша
$0.14/M
Веб-поиск
$0.01/R
Protocols
openai/v1/chat/completions/v1/responses
anthropic
Aliyun
Входные токены
$0.11/M
Выходные токены
$0.39/M
Чтение кэша
$0.011/M
Запись кэша
$0.14/M
Веб-поиск
$0.01/R
Protocols
openai/v1/chat/completions/v1/responses
anthropic

Примеры кода

from openai import OpenAI
client = OpenAI(
base_url="https://api.ofox.run/v1",
api_key="YOUR_OFOX_API_KEY",
)
response = client.chat.completions.create(
model="qwen/qwen3.8-flash",
messages=[
{"role": "user", "content": "Hello!"}
],
)
print(response.choices[0].message.content)

Доступность сервиса

Часто задаваемые вопросы

Qwen: Qwen3.8 Flash на Ofox.ai стоит $0.11/M за миллион входных токенов и $0.39/M за миллион выходных токенов. Оплата по потреблению, без абонплаты.