Qwen: Qwen3.8 Flash

Chat
qwen/qwen3.8-flash

Qwen3.8 Flash は、2026-08-25 にリリースされた Alibaba Cloud Bailian の Qwen3.8 シリーズの軽量・高速なネイティブマルチモーダルモデルです。画像と動画の理解に対応し、リクエストごとに切り替えられる深い推論(reasoning_content)をサポートします。高並列・低コストのワークロードを狙いつつ、コーディングやオフィス業務もこなします。ツール呼び出し、プロンプトキャッシュ、ウェブ検索にも対応。コンテキストウィンドウ:1.13M トークン、出力:131K。呼び出しごとに推論をオフにできるため、大半のリクエストを安く速く処理し、必要なときだけ思考を有効にする運用が可能です。Ofox 経由で OpenAI と Anthropic 両プロトコルから利用できます。

コンテキストウィンドウ
1M
最大出力トークン
131K
リリース日
2026-08-25
機能
VisionFunction Calling推論プロンプトキャッシュWeb検索動画入力
利用可能なプロバイダー
Aliyunalicloud
対応プロトコル
openaianthropic

Providers

alicloud
入力トークン
$0.11/M
出力トークン
$0.39/M
キャッシュ読込
$0.011/M
キャッシュ書込
$0.14/M
Web検索
$0.01/R
Protocols
openai/v1/chat/completions/v1/responses
anthropic
Aliyun
入力トークン
$0.11/M
出力トークン
$0.39/M
キャッシュ読込
$0.011/M
キャッシュ書込
$0.14/M
Web検索
$0.01/R
Protocols
openai/v1/chat/completions/v1/responses
anthropic

コード例

from openai import OpenAI
client = OpenAI(
base_url="https://api.ofox.run/v1",
api_key="YOUR_OFOX_API_KEY",
)
response = client.chat.completions.create(
model="qwen/qwen3.8-flash",
messages=[
{"role": "user", "content": "Hello!"}
],
)
print(response.choices[0].message.content)

稼働状況

よくある質問

Ofox.aiでのQwen: Qwen3.8 Flashの料金は、入力100万トークンあたり$0.11/M、出力100万トークンあたり$0.39/Mです。従量課金制、月額料金なし。