Qwen 3.8 Max:料金・コンテキスト長・APIアクセス方法(2026)
Qwen 3.8 Maxが2026年8月3日にGA。100万トークンあたり$2/$6、コンテキスト1M、出力上限131K、オープンウェイトは来週。ofoxでbailian/qwen3.8-maxとして利用可能。
Qwen 3.8 Maxが出ました。 Alibabaは2026年8月3日にリリースしました。プレビューから2週間後です。数字が噂でなくなったのはこのリリースからです。
- リリース: 2026年8月3日(プレビューは2026年7月19日発表)
- 料金: QwenCloudで入力$2.00/1M、出力$6.00/1M
- コンテキスト: 1Mウィンドウ(最大入力991K、最大出力131K)
- 規模: 2.4兆パラメータ、アクティブ950億
- オープンウェイト: 来週と発表、ライセンスも日付も未公開
- 今日使える経路: QwenCloud API、Qwen Studio、QwenWork
- ofox: 提供中、
bailian/qwen3.8-max、OpenAIとAnthropicの両プロトコル

TL;DR
- 新フラッグシップは前世代より安い。$2/$6に対しQwen 3.7 Maxは$2.50/$7.50。
- 最大出力が131Kトークンへ倍増。1Mのコンテキストウィンドウは据え置き。
- AlibabaはMaxクラスのモデルを初めてオープンウェイト化する。Qwen 3.8-27Bも同時、時期は「来週」(発表済み、日付未定)。
- 公式ベンチマーク表ではエージェント系の多くの行でClaude Opus 4.8を上回り、SWE-bench ProとHLEではFable 5に劣る。ベンダー作成の表である点に注意。
- その表にKimi K3の列がない。多くの人が最も見たかった比較がそこにない。
- すでにofoxで提供中。
bailian/qwen3.8-maxとして、OpenAIとAnthropicの両プロトコルで叩ける。AlibabaがClaude形状のエンドポイントを開くのを待たずにClaude Codeへ差し込める。
Qwen 3.8 Maxとは何か
Qwen 3.8 MaxはAlibabaのクローズドな最上位モデルで、トークンあたり950億をアクティブにする2.4兆パラメータのマルチモーダルシステムです。 新設計ではなくQwen 3.5アーキテクチャ上に構築されており、Alibabaは単発の対話ではなく長期の自律作業向けと位置づけています。
入出力:
| 対応状況 | |
|---|---|
| 入力モダリティ | テキスト、画像、動画(QwenCloud)。ofoxではテキストと画像、動画は未記載 |
| 出力モダリティ | テキスト |
| API機能 | Function calling、構造化出力、コンテキストキャッシュ、プレフィックス補完 |
| レート制限(QwenCloud) | 2Mトークン/分、15Kリクエスト/分 |
ローンチ記事は多日にわたる自律実行に大きく寄せています。目玉のデモは無人のコーディング実行で、公開リポジトリ上で約16日間に265コミット、127PR、151イシューを生み出しました。それが自社のコードベースにも一般化するかどうかは、ローンチ記事が答えられない唯一の点です。
Qwen 3.8 Maxはいつリリースされたか
2026年8月3日です。 プレビューが先にあり、この2つの日付は報道でしばしば混同されています。
- 2026年7月19日: 上海のWAICでQwen3.8-Max-Previewを発表。AlibabaのToken Planサブスクリプション、Qoder、QoderWork経由でのみ到達可能。従量課金API、モデルカード、ベンチマーク表のいずれもなし。
- 2026年8月3日: 一般提供。QwenCloud APIが開放され、価格が公開され、完全なベンチマーク表が公開され、オープンウェイトの時期が発表された。
この2つの間の日付の記事は「価格未公開」「ベンチマークなし」の記述が古くなっています。プレビュー期の「定価の10%」割引に言及したものも同様で、あれはToken Planのプレビュー期間だけの話です。
Qwen 3.8 Maxはオープンソースか
今日時点ではまだです。Alibabaはウェイトを来週、2026年8月10日の週に出すと述べています。
実際に発表された内容:
- Qwen 3.8 Maxのウェイトが公開される。Qwen-Maxクラスのモデルがオープンウェイトになるのは初という表現。
- Qwen 3.8-27Bも同じタイミングでオープンウェイト化。実際に動かせるのは多くの人にとってこちら。
- ライセンスの明示なし。正確な日付なし。オープン版のモデルカードやアクティブパラメータの内訳もなし。
ウェイトが実際に出るまで、3点は保留で扱ってください。ベンダーの「来週」は計画であって出荷日ではありません。商用利用ではライセンスのほうが時期より重要です。Qwenのオープンリリースは従来Apache 2.0で出ています(Qwen3-235B-A22Bは現在もHugging Faceでapache-2.0)が、それは前例であってMaxクラスでの約束ではありません。そして2.4T・アクティブ95Bのモデルはワークステーションで自己ホストする規模ではなく、ハードウェアの見通しが立つのは27Bのほうです。
Qwen 3.8 Maxの料金
QwenCloudで入力100万トークンあたり$2.00、出力100万トークンあたり$6.00(2026年8月3日時点)。 新フラッグシップは置き換え対象より20%安いことになります。
| Qwen 3.8 Max(QwenCloud) | Qwen 3.7 Max(Model Studio、シンガポール) | |
|---|---|---|
| 入力 / 1M | $2.00 | $2.50 |
| 出力 / 1M | $6.00 | $7.50 |
| 暗黙キャッシュ読み取り / 1M | $0.25 | 記載なし |
| 明示キャッシュ書き込み / 1M | $2.50 | 記載なし |
| 明示キャッシュ読み取り / 1M | $0.17 | 記載なし |
この表には注意点が2つあります。キャッシュの行は別々の価格表から来ており直接比較できません。ofoxのQwen 3.7 Maxページはキャッシュ読み取り$0.50/M、書き込み$3.125/Mと記載していますが、これはゲートウェイの掲載値でありAlibabaのものではありません。またModel Studioのシンガポール価格表は確認時点で3.7 Maxに期間限定50%オフを表示していたため、実効差は定価同士の比較より小さくなることがあります。
この表の両側の価格は動きます。コストモデルを組む前に現在値を自分で取得してください。
コンテキストウィンドウと最大出力は
合計1Mトークン。最大入力991K、最大出力131Kに分かれ、推論には別途262Kの上限があります。
- コンテキストウィンドウ: 1M
- 最大入力: 991K
- 最大出力: 131K
- 最大推論トークン: 262K
実質的な変化は出力上限です。ofoxはQwen 3.7 Maxを同じ1Mウィンドウで最大出力64Kと記載しているので、3.8 Maxは1応答あたりの出力量が倍になります。これはAlibabaが狙う負荷にとって重要です。262Kの推論トークンで計画を立てながら成果物を書くのに64Kしかないモデルは、途中で切れるモデルです。
公式ベンチマークは何を示しているか
Alibabaはローンチ時に完全な比較表を公開しましたが、全勝ではなく勝ち負けが混在しています。 以下の数値はすべてベンダー申告です。
主要行、Qwen 3.8 Max対フロンティア勢:
| ベンチマーク | Qwen 3.8 Max | Opus 4.8 | Fable 5 | GPT-5.6 Sol (max) | Qwen 3.7 Max |
|---|---|---|---|---|---|
| Terminal Bench 2.1 | 86.6 | 84.6 | 84.6 | 88.8 | 74.5 |
| SWE-bench Pro | 67.7 | 69.2 | 80.0 | 64.6 | 60.6 |
| PaperBench | 93.0 | 80.3 | 88.8 | 90.5 | 64.8 |
| GPQA Diamond | 92.6 | 92.0 | 92.6 | 94.1 | 92.4 |
| HLE | 43.6 | 45.7 | 53.3 | 47.2 | 41.4 |
| IFBench | 82.8 | 62.2 | 63.5 | 72.7 | 79.1 |
| OSWorld-Verified | 86.1 | 83.4 | 85.0 | 83.2 | 73.3 |
| MMMU-Pro | 82.3 | 75.6 | 81.2 | 83.0 | 79.0 |
いつも通り割り引いて読んでください。競合のTerminal Benchの数値はQwenが再実行したものではなく、Artificial AnalysisとOpenAI自身の投稿から引用されています。SWE-bench Proの行はClaude Codeハーネス、temp 1.0、top_p 0.95、256Kコンテキストという、Qwenが選んだ構成での測定です。表にはQwen自社製のベンチマーク(QwenSWEBench、QwenQoderBench、QwenReactBench)の行もあり、そこで測られているのは名前を共有するモデルです。
表の中の何よりも雄弁なのは欠落です。Kimi K3の列がありません。 Moonshotのオープンウェイト・フラッグシップはQwen 3.8プレビューの数日前に出ており、Qwen 3.8 Maxについて最もよく聞かれる比較対象です。Alibabaは代わりに西側のクローズドモデル3つと自社の前世代を並べました。
Qwen 3.8 Maxへのアクセス方法
今日はQwenCloud経由です。 一次経路が3つ、そして広く報道された4つ目は自分で確認が要ります。
- QwenCloud API。モデルID
qwen3.8-max、開発者向けの経路。キーはhome.qwencloud.com/api-keysから。 - Qwen Studio。
chat.qwen.ai、チャットインターフェース。 - QwenWork。非開発者向けの業務エージェントプラットフォーム。
- Alibaba Cloud Model Studio。SCMPは8月3日にグローバルAPIアクセスを報じました。ただし同日の確認時点でModel Studioの英語モデル一覧と価格表は
qwen3.7-max止まりでした。エンドポイントは共通でも、カタログページが告知に遅れています。
この最後の点はブランド名に隠れているので補足します。QwenCloud自身の開発者ガイドが叩くOpenAI互換エンドポイントはhttps://dashscope-intl.aliyuncs.com/compatible-mode/v1で、キーはDASHSCOPE_API_KEYから読みます。Model Studioと同じDashScope国際ホストです。QwenCloudはその基盤の上のフロントエンドであって、別のAPIではありません。
呼び出しはOpenAI形状です:
import os
from openai import OpenAI
client = OpenAI(
api_key=os.getenv("DASHSCOPE_API_KEY"),
base_url="https://dashscope-intl.aliyuncs.com/compatible-mode/v1",
)
resp = client.chat.completions.create(
model="qwen3.8-max",
messages=[{"role": "user", "content": "このリポジトリのテスト戦略を要約して。"}],
max_tokens=4096,
)
print(resp.choices[0].message.content)
Alibabaが用意していない経路: Anthropicプロトコル
QwenのAPIはOpenAI形状のみなので、Claude Codeはqwen3.8-maxを直接呼べません。 Claude CodeはAnthropic Messagesプロトコルを話し、譲りません。ゲートウェイがこの隙間を初日に埋めます。
bailian/qwen3.8-maxはローンチと同じ日にofoxで公開されました。2026年8月3日のカタログ呼び出しでは123モデルが返り新IDが含まれ、モデルページには入力$2/M、出力$6/M、キャッシュ読み取り$0.25/M、書き込み$2.50/M、コンテキスト長1,131,072、補完上限131,072と記載されています。価格は4行ともQwenCloudの定価と一致します。
ひとつ注意喚起を。危うく引っかかるところでした。カタログのsupported_endpointsフィールドには/v1/chat/completionsと/v1/responsesしか載っておらず、Anthropic経路が閉じているように読めます。閉じていません。2026年8月3日の実際のMessages呼び出しはstop_reason: end_turnを含む正常な応答を返しました。このフィールドを前提に設計する前に、実リクエストを1本投げてください。
シェル2行でClaude Codeに差し込めます:
export ANTHROPIC_BASE_URL=https://api.ofox.run/anthropic
export ANTHROPIC_MODEL=bailian/qwen3.8-max
あるいは上のPythonのまま引数を2つ変えるだけです:
client = OpenAI(
api_key=os.getenv("OFOX_API_KEY"),
base_url="https://api.ofox.run/v1",
)
resp = client.chat.completions.create(model="bailian/qwen3.8-max", ...)
どちらの経路を取るか:
| 求めるもの | QwenCloudに直接 | ゲートウェイ経由 |
|---|---|---|
| 最安のトークン単価 | はい、これが定価 | ここでは定価と同額。モデルごとに要確認 |
| Qwen独自機能への初日アクセス | はい | ゲートウェイの追随分だけ遅れる |
| Claude CodeなどAnthropicプロトコル系のツール | 今日は不可 | 可能 |
| Qwen・Claude・GPT・Geminiを1キーで | 不可 | 可能 |
| 特定ベンダーのレート制限時のフェイルオーバー | 自前で構築 | 標準装備 |
正直な代償として、ゲートウェイは自分で制御できないホップを1つ増やしますし、その価格表はベンダーの期中改定に遅れることがあります。マーケティングページではなくモデルページを読んでください。これは自社についても同じです。
Qwen 3.8 Max対Qwen 3.7 Max
安くなり、出力上限が倍になり、エージェント系ベンチマークが大きく伸びた。
| Qwen 3.8 Max | Qwen 3.7 Max | |
|---|---|---|
| リリース | 2026-08-03 | 2026-05-19 |
| パラメータ | 2.4T(アクティブ95B) | 未公開 |
| コンテキスト / 最大出力 | 1M / 131K | 1M / 64K(ofox掲載) |
| 入力 / 出力(1Mあたり) | $2.00 / $6.00 | $2.50 / $7.50 |
| Terminal Bench 2.1 | 86.6 | 74.5 |
| SWE-bench Pro | 67.7 | 60.6 |
| ofox | あり、bailian/qwen3.8-max | あり、bailian/qwen3.7-max |
特段の理由がなければ3.8 Maxを選んでください。安く、1応答で書ける量が倍で、どちらも同じキーで到達できるため、移行は統合作業ではなくモデルIDの差し替えで済みます。3.7 Maxに留まるのは、再現性のためにバージョンを固定している場合か、評価セットがそれに合わせて較正されている場合だけです。価格差は20%であって桁違いではないので、コストだけでは移行の決め手になりません。前世代の詳細はQwen 3.7 MaxのCoding Arena評価とClaude Opus比較を参照してください。
このローンチが再燃させたベンダー横断の問いについては、Kimi K3対GPT-5.5・Opus 4.8がオープンウェイト側を、Kimi K3の使い方がアクセス方法を扱っています。両方とも今日ofoxで使えます。K3はmoonshotai/kimi-k3、こちらはbailian/qwen3.8-maxなので、比較は調達判断ではなくモデルIDの差し替えです。
FAQ
Qwen 3.8 Maxはいつ出ましたか? 2026年8月3日、価格とベンチマークを伴う一般提供リリースです。プレビュー版は2026年7月19日発表で、AlibabaのToken Plan、Qoder、QoderWorkに限定されていました。
Qwen 3.8 Maxは無料ですか? 無料ではありません。QwenCloudでトークン課金、1Mあたり$2/$6です。7月のプレビューはToken Plan加入者向けに定価の10%と報じられましたが、その期間は終了しています。
Qwen 3.8 Maxのウェイトをダウンロードできますか? まだできません。Alibabaは2026年8月10日の週にオープンウェイトを公開すると発表しましたが、ライセンスも正確な日付もありません。同じ発表に含まれるQwen 3.8-27Bが、現実的な自己ホストの対象です。
Qwen 3.8 Maxは画像入力に対応していますか? 画像は対応、動画は要注意です。QwenCloudのモデルページは入力モダリティにテキスト・画像・動画を挙げ、Alibabaのマルチモーダル表はMMMU-Pro 82.3、OSWorld-Verified 86.1を報告しています。ofox経由では2026年8月3日に送った画像が正しく説明され、プロンプトトークンが60から90へ増えたので画像入力は有効です。ただし動画はofoxのカタログエントリに含まれていないため、使えると仮定しないでください。
Qwen 3.8 MaxをClaude Codeで使えますか?
QwenCloudに直接ではできません。Claude CodeはAnthropic Messagesプロトコルを話し、QwenCloudはOpenAI形状だからです。両方を話すゲートウェイ経由なら初日から動きます(2026年8月3日に実測)。ANTHROPIC_BASE_URLをhttps://api.ofox.run/anthropicに向け、ANTHROPIC_MODEL=bailian/qwen3.8-maxを設定してください。
Qwen 3.8 MaxとQwen 3.8-27Bの違いは? Maxは2.4Tのクローズドなフラッグシップで、現在APIで利用できます。27Bははるかに小さいモデルで、来週のオープンウェイト公開で発表されています。同世代ですが規模のクラスが違います。
Qwen 3.8 MaxはKimi K3より優れていますか? Alibabaはその比較を公開していません。ベンチマーク表にK3の列はありません。可用性の面でも対等ではなく、K3には現時点でオープンウェイトと幅広いゲートウェイ対応がありますが、3.8 Maxにはまだありません。
今回確認したソース
- https://qwen.ai/blog?id=qwen3.8
- https://x.com/Alibaba_Qwen/status/2084100707423289643
- https://www.qwencloud.com/models/qwen3.8-max
- https://docs.qwencloud.com/developer-guides/text-generation/function-calling
- https://www.alibabacloud.com/help/en/model-studio/model-pricing
- https://www.alibabacloud.com/help/en/model-studio/models
- https://www.scmp.com/tech/article/3362738/alibabas-ai-model-qwen38-max-made-widely-accessible-ahead-open-weights-release
- https://huggingface.co/Qwen/Qwen3-235B-A22B
- https://ofox.run/ja/models/bailian/qwen3.8-max
- https://ofox.run/ja/models/bailian/qwen3.7-max
GET https://api.ofox.run/v1/models(2026年8月3日の実行: 07:30時点で122モデル、08:20時点で123モデルかつbailian/qwen3.8-maxを含む)bailian/qwen3.8-maxに対する実リクエスト検証、2026年8月3日:POST /anthropic/v1/messages(200、Anthropic形状のボディ)、POST /v1/chat/completions(200)、および画像入力1件(200、説明は正確、プロンプトトークンは画像なしの60に対し90)
よくある質問
- Qwen 3.8 Maxはいつリリースされましたか?
- 2026年8月3日です。AlibabaのQwenチームが同日に「Qwen3.8-Max: A New Bar for Coding and Cowork」を公開し、同時にQwenCloudのAPIを開放しました。それ以前にプレビュー版があり、Qwen3.8-Max-Previewは2026年7月19日に発表され、AlibabaのToken Planサブスクリプション、Qoder、QoderWork経由でのみ利用できました。8月3日はGA(一般提供)であって、初出ではありません。
- Qwen 3.8 Maxはオープンソースですか?
- 現時点ではまだですが、Alibabaは公開すると述べています。ローンチ記事には、Qwen-Maxクラスのモデルのウェイトを公開するのはこれが初めてであり、公開は「来週」つまり2026年8月10日の週だと書かれています。Qwen3.8-27Bも同じタイミングでオープンウェイト化されます。8月3日時点の確認では、ライセンス、正確な日付、いずれのモデルカードも未公開です。したがってこの時期は「発表済み」であって「確定」ではありません。
- Qwen 3.8 Maxの料金はいくらですか?
- QwenCloudでは入力100万トークンあたり$2.00、出力100万トークンあたり$6.00です(2026年8月3日時点)。キャッシュは別料金で、暗黙キャッシュ読み取り$0.25/M、明示キャッシュ書き込み$2.50/M、明示キャッシュ読み取り$0.17/Mです。これは前世代より安く、Qwen 3.7 MaxはAlibaba Cloud Model Studioのシンガポール価格表で入力$2.50、出力$7.50でした。新フラッグシップは両側とも20%の値下げです。
- Qwen 3.8 Maxのコンテキストウィンドウは?
- 合計1Mトークンで、QwenCloudのモデルページでは最大入力991K、最大出力131Kに分けられ、推論トークンには別途262Kの上限があります。注目すべきは131Kという出力上限です。ofoxではQwen 3.7 Maxの最大出力が64Kなので、同じ1Mウィンドウのまま1回の応答で書ける量が約2倍になりました。
- Qwen 3.8 Maxにアクセスするには?
- 2026年8月3日時点で一次経路は3つです。QwenCloud API、chat.qwen.aiのQwen Studioチャット、そして非開発者向けのQwenWorkです。APIはOpenAI互換で、QwenCloudの開発者ガイドはhttps://dashscope-intl.aliyuncs.com/compatible-mode/v1をDASHSCOPE_API_KEYで叩くよう案内しています。これはAlibaba Cloud Model Studioと同じDashScope国際ホストです。確認時点でModel Studioの英語モデル一覧と価格表は最新のMaxがqwen3.7-maxのままで、カタログページがローンチに遅れています。
- Qwen 3.8 Maxはofoxで使えますか?
- 使えます。モデルIDはbailian/qwen3.8-maxで、ローンチ当日に追加されました。2026年8月3日のGET /v1/models実行では123モデルが返り、新エントリが含まれていました。ofoxのモデルページには入力$2/M、出力$6/M、キャッシュ読み取り$0.25/M、キャッシュ書き込み$2.50/M、コンテキスト長1,131,072、補完上限131,072と記載され、価格4行すべてがQwenCloudの定価と一致します。同日の実測でOpenAIプロトコルとAnthropicプロトコルの両方が応答しました。Claude、GPT、Geminiと同じキーで使えます。
- Qwen 3.8 Maxのパラメータ数は?
- 総パラメータ2.4兆、トークンごとのアクティブパラメータ950億で、Qwen 3.5アーキテクチャ上に構築されています。推論コストと速度に効くのはアクティブ側の数字で、各トークンが総ウェイトの約4%だけを通ることを意味します。Alibabaは8月3日のローンチ記事で両方の数字を開示しました。7月のプレビュー時は2.4Tという総数しか公開されていませんでした。
- Qwen 3.8 MaxはClaude Opus 4.8やGPT-5.6より優れていますか?
- タスク次第であり、以下の数値はすべてAlibaba自身の表からのものです。Qwen 3.8 MaxはPaperBench(93.0)、IFBench(82.8)、OSWorld-Verified(86.1)で表の首位です。一方Terminal Bench 2.1(86.6、GPT-5.6 Sol maxは88.8)、SWE-bench Pro(67.7、Fable 5は80.0)、HLE(43.6、Fable 5は53.3)では下回ります。ベンダー実施の表はハーネスを自ら選べるため、確定した順位ではなく検証すべきローンチ時の主張として扱ってください。


