DeepSeek V4.1 Flash・Gemini 3.8 Flash・Qwen3.8 Flash比較

DeepSeek、Google、Alibaba Cloudの高速モデルを料金、コンテキスト、マルチモーダル入力、API互換性、ツールと運用条件で比較します。

淡い紙に描かれた黒インクの双眼鏡と、DeepSeek V4.1 Flash Cross-Brand Comparisonの表紙。

選択は用途によって変わります。DeepSeek V4.1 Flashは直接接続の公開USD単価がGeminiより低く、Gemini 3.8 Flashはネイティブのマルチモーダル入力と内蔵ツールが最も幅広く、Qwen3.8 Flashは1Mコンテキスト、地域別の配備、既存クライアントで使いやすいAPIを組み合わせています。 文書で確認できる機能の比較であり、ベンチマークの勝者を決めるものではありません。

2026年9月14日に各社の公式文書に照らして更新しました。料金は変動し、通貨、地域、優待期間が異なるため、そのまま比較できません。接続と請求の詳細はDeepSeek V4.1 Flash APIガイドGemini 3.8 Flash料金・接続ガイドを参照してください。

主な違い

項目DeepSeek V4.1 FlashGemini 3.8 FlashQwen3.8 Flash
提供元DeepSeekGoogleAlibaba Cloud
コンテキスト上限1M1,048,576トークン1M
最大出力384K65,536トークン131,072トークン
ネイティブ入力テキスト、画像テキスト、画像、動画、音声、PDFテキスト、画像、動画
公開API形式OpenAI、Anthropic、ResponsesGemini API、OpenAI互換OpenAI・Anthropic互換
ツール・出力機能ツール呼び出し、JSON出力関数呼び出し、コード実行、検索グラウンディング、computer useプレビュー、構造化出力関数呼び出し、構造化出力、北京・シンガポールでのWeb検索
最初に評価したい用途費用重視のテキスト・画像処理、コーディングエージェント多様な入力を扱う処理、Google連携エージェント地域別配備、長いマルチモーダルコンテキスト

コンテキストの大きさは容量の上限です。必要な根拠を見つける、ツールの仕様を守る、使える10万トークンの回答を書く能力を証明しません。それぞれ別にテストしてください。

同じトークン数で料金を比べる

非キャッシュ入力100万トークンと、課金対象の思考を含む出力20万トークンを使う場合、公開単価から次の計算例が得られます。

経路と適用期間入力出力計算上の合計
DeepSeek直接接続、オフピーク$0.15/M$0.60/M$0.27
DeepSeek直接接続、ピーク$0.30/M$1.20/M$0.54
Gemini 3.8 Flash、2026年12月31日までの導入価格$0.75/M$3.75/M$1.50
Qwen3.8 Flash、北京のオリジナル配備¥0.80/M¥2.70/M¥1.34

DeepSeekのキャッシュヒット入力はオフピーク$0.003/M、ピーク$0.006/Mです。Gemini Standardの導入期間中のキャッシュ入力は$0.075/Mで、保存料は別です。Qwenの北京料金ではキャッシュヒットが¥0.10/Mです。これらはトークン数を固定した算術例であり、タスク費用の実測ではありません。ツール、キャッシュ保存、再試行を除いています。Qwenの¥は人民元を示します。為替レートと課金地域を固定せずに換算して精度があるように見せないため、人民元のまま示しています。

トークン単価と完了タスクの費用は異なります。再試行、出力長、キャッシュヒット率、ツールの失敗、検索グラウンディング料金も含めます。GeminiのStandard料金は導入期間終了後に変更予定で、Qwenは地域ごとに料金が異なります。

入力形式とツールで候補を絞る

1リクエストで音声、動画、PDF、画像をネイティブに組み合わせる必要がある場合や、Google Searchとコード実行が中心の処理では、Geminiを先に評価できます。この3モデルでは、ネイティブAPIがより多くのマネージドツールを提供しています。

画像・動画の理解、1Mコンテキスト、Alibaba Cloudの地域別配備がすべて必要ならQwenを先に試します。OpenAI・Anthropic互換はクライアントの移行作業を減らせますが、機能が同じかはテストが必要です。Web検索は北京とシンガポールで対応し、文書ではフランクフルト、東京、バージニア、香港で提供されていません。

テキスト、スクリーンショット、コーディングエージェントが中心で、直接接続のトークン費用が大きな制約ならDeepSeekを先に試します。画像入力、ツール呼び出し、一般的なクライアント形式に対応し、公開されている最大出力はGeminiやQwenより大きくなっています。ただし、上限が高くても毎回の回答を長くする必要はありません。

API互換性だけでは挙動は一致しない

OpenAI互換エンドポイントなら、認証の構成、チャットのリクエスト、SDK接続部分を再利用できることが多くあります。しかし、ツールスキーマ、ストリーミングイベント、推論制御、マルチモーダル入力の符号化、エラー応答が同じとは限りません。固有機能には各社のネイティブAPIが必要なことがあります。

候補ごとに同じテスト手順を実行します。

  1. 失敗例や境界条件を含む20〜50の代表タスクを使う。
  2. 地域、モデルID、temperature、ツール定義、出力スキーマを固定する。
  3. 合格率、最初の有用な出力までの時間、全トークン、再試行を記録する。
  4. レート制限からの復帰と、提供元の障害シナリオを1つ試す。
  5. リクエストあたりではなく、合格した結果あたりの費用を計算する。

どれを最終候補にする?

優先事項最初の候補追加で確認すること
Geminiより低い直接接続USD単価DeepSeek V4.1 Flash品質、ピーク・オフピークの時間帯、キャッシュ料金
音声・動画・PDFとマネージドツールGemini 3.8 FlashネイティブAPIの実装、優待期間後の費用
Alibabaの地域別配備と長いマルチモーダル入力Qwen3.8 Flash地域別料金、割り当て、モデル可用性
既存のOpenAI形式クライアント文書化された互換エンドポイントを使える3モデルのいずれかストリーミング、ツール呼び出し、スキーマの挙動

OfoxにはGemini 3.8 Flashが掲載され、OpenAIとGeminiの両プロトコルに対応しています。必要なプロトコルを選び、提供経路の料金を確認してください。各社のネイティブ機能がすべての互換層で使えるとは限りません。今回の更新は文書上の機能確認であり、有料推論による比較ではありません。

仕様表だけで万人に共通する勝者は決まりません。表から2候補を選び、実際の合格テストで判断してください。

公式資料

よくある質問

最も安いFlashモデルは?
表の直接接続USD単価ではDeepSeekがGeminiを下回ります。Qwenは地域別の人民元料金なので、3モデルの最安ランキングではありません。同じ処理量、通貨、地域、キャッシュ条件で比較してください。
マルチモーダルAPIが最も広いのは?
この比較ではGemini 3.8 Flashが最も多いネイティブ入力形式を持ち、テキスト、画像、動画、音声、PDFに対応します。Qwen3.8 Flashはテキスト・画像・動画、DeepSeek V4.1 Flashはテキスト・画像に対応します。
3モデルともOpenAI互換クライアントで使えますか?
DeepSeekとQwenはOpenAI互換エンドポイントを文書化しています。Geminiにも互換層がありますが、固有機能にはGoogleのSDKやリクエスト形式が必要な場合があります。
仕様だけで選んでよいですか?
いいえ。同じ代表プロンプト、ツール、合格基準で試し、採用できる結果あたりの費用、待ち時間、運用上の制約を比較してください。