Qwen: Qwen3.8 Flash

Chat
qwen/qwen3.8-flash

Qwen3.8 Flash 是阿里云百炼 Qwen3.8 系列的轻量高速原生多模态模型,2026-08-25 发布。它支持图像与视频理解,并支持可按请求开关的深度推理(reasoning_content),面向高并发、低成本场景,同时兼顾编程与办公任务。另支持工具调用、提示缓存与联网搜索。上下文窗口:1.13M tokens,输出:131K。推理可逐次调用关闭,因而可以让大部分请求跑得又快又便宜,只在需要时才启用思考。通过 OpenAI 与 Anthropic 双协议接入 Ofox。

上下文窗口
1M
最大输出 Token
131K
发布日期
2026-08-25
能力
视觉函数调用推理提示缓存网络搜索视频输入
可用供应商
Aliyunalicloud
支持的协议
openaianthropic

供应商

alicloud
输入 Token
$0.11/M
输出 Token
$0.39/M
缓存读取
$0.011/M
缓存写入
$0.14/M
网络搜索
$0.01/R
接入协议
openai/v1/chat/completions/v1/responses
anthropic
Aliyun
输入 Token
$0.11/M
输出 Token
$0.39/M
缓存读取
$0.011/M
缓存写入
$0.14/M
网络搜索
$0.01/R
接入协议
openai/v1/chat/completions/v1/responses
anthropic

代码示例

from openai import OpenAI
client = OpenAI(
base_url="https://api.ofox.run/v1",
api_key="YOUR_OFOX_API_KEY",
)
response = client.chat.completions.create(
model="qwen/qwen3.8-flash",
messages=[
{"role": "user", "content": "Hello!"}
],
)
print(response.choices[0].message.content)

运行状态

常见问题

Qwen: Qwen3.8 Flash 在 Ofox.ai 上的价格为输入 $0.11/M/百万 Token,输出 $0.39/M/百万 Token。按量计费,无月费。