DeepSeek API 料金:公式レートと100万トークン単価(2026)
2026-08-18 に公式料金ページから読み取った現行レート。V4 Flash はオフピーク入力 100万トークン $0.22、V4 Pro は $0.66。キャッシュ計算と月額試算つき。
9月10日更新: V4.1 Flash が公式 API で利用可能になりました。最新料金と計算例は V4.1 Flash の料金ガイド、9月14日の Pro リクエストの移行は移行チェックリストを参照してください。以下の本文と FAQ は旧 V4 の当時の情報を残したもので、V4.1 の現在の料金や提供状況を示すものではありません。
2026-08-18 にレートを再確認しました。 このページの DeepSeek の数値はすべて、同日に公式の料金ページから読み取ったものです。2026-08-16 16:00 UTC に発効したピーク / オフピーク課金への移行後の値になります。どの段が何倍になったのか、なぜこう変わったのかは DeepSeek API 値上げにまとめてあります。
DeepSeek V4 Flash は 100万入力トークンあたりオフピーク $0.22、ピーク $0.44、出力はそれぞれ $0.66 と $1.32 です。 V4 Pro は入力と出力でその 3 倍、キャッシュヒットでは 3 倍をわずかに超えます。キャッシュヒットはミスの約 3% しかかからず、請求額に効く単独のレバーとしては最大のものです。ピークは 1 日 7 時間、UTC 01:00-04:00 と 06:00-10:00 で、オフピークはちょうど半額です。 時計を気にしながらジョブを回すより、DeepSeek・Claude・GPT・Gemini を 1 本のキーで扱いたいなら、ofox.ai は両モデルを終日ピーク価格で提供しています。
ofox.ai から DeepSeek V4 に接続、OpenAI 互換エンドポイントで。
DeepSeek V4 Flash とは何ですか?
V4 Flash は DeepSeek の現行の量産向けモデルで、より高性能な V4 Pro と併売されています。どちらも 1M トークンのコンテキストウィンドウを持ち、1 回の応答で最大 384K の出力トークンを生成します。現在の API では deepseek-v4-flash が DeepSeek-V4-Flash-0731 を、deepseek-v4-pro が DeepSeek-V4-Pro-0813 を指します。
V4 Pro が上乗せしているのは多段推論の深さで、3 倍のトークン単価はそこに払っています。V4 Flash が受け持つのは日常の作業、要約・分類・チャット・普通のコーディングです。どちらも思考モードが既定で有効になっており、切り替え方は別のガイドに記載されています。
かつてどの DeepSeek チュートリアルにも載っていた 2 つの ID、deepseek-chat と deepseek-reasoner は、2026-08-18 時点で料金ページにも初回呼び出しページにもモデル表に見当たりません。コードがまだこれらを送っているなら、まだ通ると決めつけずに一度試す価値があります。
公式の DeepSeek API 料金はいくらですか?
以下はすべて 100万トークンあたり、2026-08-18 の公式料金ページからの値です。どの行もオフピークはピークのちょうど半額です。
| モデル | 入力(キャッシュヒット) | 入力(キャッシュミス) | 出力 | コンテキスト | 最大出力 |
|---|---|---|---|---|---|
deepseek-v4-flash オフピーク | $0.007 | $0.22 | $0.66 | 1M | 384K |
deepseek-v4-flash ピーク | $0.014 | $0.44 | $1.32 | 1M | 384K |
deepseek-v4-pro オフピーク | $0.022 | $0.66 | $1.98 | 1M | 384K |
deepseek-v4-pro ピーク | $0.044 | $1.32 | $3.96 | 1M | 384K |
ピークは UTC 01:00-04:00 と 06:00-10:00、1 日 7 時間で、日本時間なら 10:00-13:00 と 15:00-19:00 です。残り 17 時間はオフピークになります。仕組みはこれだけで、選べるプランもなければ設定するフラグもなく、ピーク中にオフピーク価格を買う方法もありません。
本当に効くのはキャッシュの行です。同じ段でヒットはミスの約 3%、その分のトークンにおよそ 97% の割引がかかり、プロンプトの接頭辞が DeepSeek 側の保持分と一致すれば自動的に適用されます。設定も不要、別エンドポイントも不要です。この列をじっと見る価値があるのは、本番のプロンプトの大半が接頭辞だからです。システムプロンプト、ツールのスキーマ、ターンをまたいで変わらないドキュメント。
公式が書いていないことが 1 つあります。オフピークに始まりピークに終わったリクエストが、開始時刻と終了時刻のどちらで課金されるのかです。UTC 04:00 や 10:00 に接した長いセッションを回すなら、これは既知の答えではなく未確定事項です。
実際、1 か月でいくらかかりますか?
月あたり入力 1,000万トークン、出力 200万トークンのワークロードを V4 Flash で 3 通りに見積もります。
| ケース | オフピーク | ピーク |
|---|---|---|
| キャッシュを一切使わない | $3.52 | $7.04 |
| 入力の 80% がキャッシュヒット | $1.82 | $3.63 |
| 同じ量を V4 Pro で、キャッシュなし | $10.56 | $21.12 |
最初の 2 行の差が、プロンプトを安定した接頭辞を軸に組み立てる理由です。2 つの列の差が、バッチ的な仕事をピークの 7 時間から動かす理由になります。夜間のドキュメント処理、データセットのアノテーション、一括要約はいずれもスケジュール可能です。
リクエスト単位に直すと、2,000 トークンのシステムプロンプトが毎回キャッシュに当たる場合、100万リクエストあたりオフピークで $426、ピークで $852 の節約になります。モデルを変えずに自分で動かせる項目としては、これが最大です。
DeepSeek の API キーはどう取得しますか?
platform.deepseek.com にメールアドレスで登録し、ログイン後に API Keys からキーを生成します。
ベース URL は OpenAI 互換が https://api.deepseek.com、Anthropic 互換が https://api.deepseek.com/anthropic で、同じキーのまま base_url を変えればどちらの SDK からでも呼べます。JSON 出力、ツール呼び出し、Responses API、チャット接頭辞補完はどちらのモデルでも使えます。FIM 補完はベータで、非思考モードのみです。
課金は入金残高と付与残高の 2 本立てで、両方ある場合は付与残高から先に消費されます。継続的な無料枠はドキュメントに書かれていないので、登録時のクレジットはプランではなく試用と見なすのが安全です。
実務上の注意を 1 つ。DeepSeek が公表しているのは同時実行数の上限であって、稼働率の約束ではありません。参照できる公開ステータスページもありません。本番前提で作るなら、余裕があると仮定せず、フォールバックは自分で設計してください。
ofox 経由で DeepSeek を使うには?
ofox.ai では DeepSeek V4 Flash が deepseek/deepseek-v4-flash-0731 として入力 $0.44・出力 $1.32、DeepSeek V4 Pro が deepseek/deepseek-v4-pro-0813 として入力 $1.32・出力 $3.96 です。これは公式のピーク価格を終日適用したもので、ピークとオフピークの区別はありません。
これははっきり書いておきます。両側に効く話だからです。オフピークの 17 時間は、公式に直接つなぐほうがゲートウェイ経由の半額で済みます。 ピークの 7 時間は同額です。ゲートウェイで買えるのは、使うすべてのモデルを 1 本のキーで扱えること、請求が 1 通にまとまること、そして公式プラットフォームが混んだときの逃げ道です。呼ぶモデルが DeepSeek だけで、ジョブがバッチ的なら直接接続のほうが安く、コストレビューではそう明言すべきです。
キャッシュを気にするなら知っておきたい点がもう 1 つ。同じモデル ID でも上流の経路は 1 つとは限らず、キャッシュ読み取りの単価は経路ごとに違います。V4 Flash の場合、DeepSeek と BaiLian の経路では 100万あたり $0.014、Azure の経路では $0.44、つまり入力と同額でキャッシュ割引が実質ありません。経路ごとの最新の内訳は DeepSeek モデルページにあります。
実利は、Claude・GPT・Gemini・Qwen を含む 2026-08-18 時点で 130 を超えるモデルを 1 本の API キーで扱えることです。アカウントも請求も分けずに済みます。タスク種別やコストでモデルを振り分けるなら効きます。詳しくは AI API アグリゲーションガイドにあります。
設定は 3 行です。
from openai import OpenAI
client = OpenAI(api_key="sk-xxx", base_url="https://api.ofox.run/v1")
response = client.chat.completions.create(
model="deepseek/deepseek-v4-flash-0731",
messages=[{"role": "user", "content": "Explain the 1M token context window in one paragraph"}]
)
OpenAI SDK からの移行なら、移行ガイドで 10 分もかからず入れ替えられます。
DeepSeek API のコストをどう下げますか?
キャッシュ割引が最大のレバーで、しかも以前より効きます。入力が $0.14 だった頃はヒット 1 回で 100万トークンあたり $0.137 の節約でしたが、オフピーク $0.22 の今は $0.213 です。システムプロンプトと変化しないコンテキストを先頭に置いてください。そこが最もキャッシュされやすい部分です。設定は不要で、接頭辞が一致すれば適用されます。実際の請求書で命中率が設計値を下回りがちな理由は、キャッシュヒットの実算で扱っています。
2 つ目のレバーは新しく生まれたものです。今すぐ動かす必要のない処理をピークの外に出す。 夜間のドキュメント処理、データセットのアノテーション、一括要約はどれもスケジュールでき、オフピークはキャッシュ読み取りを含めて全行が半額です。ピークの 7 時間は UTC 01:00-04:00 と 06:00-10:00 なので、どれだけ不便かは所在地次第です。日本のチームは 10:00-13:00 と 15:00-19:00、つまり業務時間のかなりの部分が該当します。
3 つ目はモデル選択です。深い推論が本当に必要なときだけ deepseek-v4-pro を使ってください。Pro はキャッシュミス入力と出力でちょうど Flash の 3 倍なので、分類・要約・単純な生成を Pro で回すのは、得るもののない 3 倍の請求です。
コンテキストの刈り込みも依然として効きます。1M のウィンドウは広いものの、キャッシュに当たらない入力トークンにはすべて課金されます。関連する断片だけを引く RAG のほうが、文書を丸ごと詰め込むより安上がりです。そのパターンは embedding と RAG のガイドにあります。モデル横断の一般的な節約策は AI API のコスト削減にまとめてあります。
DeepSeek と他モデルの価格はどう違いますか?
以下はすべて 2026-08-18 の ofox 単価、100万トークンあたりです。出所を 1 つに揃えているため、DeepSeek の行はオフピークではなくピーク価格になります。
| モデル | 入力 | 出力 |
|---|---|---|
| Qwen Max | $0.35 | $1.38 |
| DeepSeek V4 Flash | $0.44 | $1.32 |
| DeepSeek V4 Pro | $1.32 | $3.96 |
| GLM 5.2 | $1.40 | $4.40 |
| Claude Sonnet 5 | $2 | $10 |
| Kimi K3 | $3 | $15 |
| Claude Opus 5 | $5 | $25 |
| GPT-5.6 Sol | $5 | $30 |
V4 Flash は入力で Claude Sonnet 5 の 4.5 分の 1、出力で 7.6 分の 1、入力は Claude Opus 5 や GPT-5.6 Sol のおよそ 11 分の 1 です。ただしこの表で最安ではありません。Qwen Max は入力で約 20% 下回り、負けているのは出力だけです。DeepSeek が無条件に最安だと言う人がいたら、しばらく確認していないのだと思ってください。
トレードオフはいつもどおりです。公式が公表しているのは同時実行数の上限であって稼働率の約束ではなく、込み入った英語の指示追従でも上位モデルに及ばないことがあります。価格ではなく能力の比較はモデル比較ガイドにあります。
スケールさせる前に知っておくべき制限は?
知らないと後で刺さるものをいくつか。
- 同時実行数はモデルごとに上限が設定されていて、両者の差は小さくありません。V4 Flash が 2,500 同時リクエストなのに対し、V4 Pro は 500 です。Pro 中心のパイプラインは 5 倍早く壁に当たります。
- レート制限はアカウントの段階によって変わり、新規アカウントは控えめから始まります。量をかけて試すなら到達すると考えてください。
- 1M トークンのコンテキストは入力のみです。最大出力は両モデルとも 384K です。
- 思考モードは両モデルで既定です。料金ページは切り替え方を別のガイドに委ねており、勘で指定できるリクエストパラメータではありません。
- FIM 補完はベータで、両モデルとも非思考モードでのみ動きます。
- 価格は動きます。公式の料金ページ自身がこう書いています。「Product prices may vary and DeepSeek reserves the right to adjust them. We recommend topping up based on your actual usage and regularly checking this page for the most recent pricing information.」2026-08-16 の規模の変更のあとでは、これは定型句ではありません。
まとめ
オフピークの 100万入力トークンあたり $0.22、キャッシュされた接頭辞にはさらに約 97% 引き。V4 Flash は依然として、実用に耐えるモデルの中で最も安い部類です。 8 月に変わったのは、請求が時計に依存するようになったことです。同じジョブでも UTC 01:00-04:00 と 06:00-10:00 に落ちれば 2 倍かかります。プロンプトはキャッシュが効く形に組み、バッチ処理はその 7 時間の外へ、V4 Pro は本当に必要な仕事だけに使ってください。
DeepSeek V4 を Claude Code のバックエンドに据えた場合の実コスト分析(キャッシュ命中率の現実値と品質のトレードオフを含む)は Claude Code での DeepSeek V4 コスト内訳にあります。V4 Pro 0813 が 3 倍の価格で何を返すのかは V4 Pro 0813 の詳細へ。始めるなら platform.deepseek.com、あるいは DeepSeek と Claude・GPT・Gemini を 1 本のキーでまとめたいなら ofox.ai を使ってください。
References
よくある質問
- DeepSeek API の料金はいくらですか?
- 100万トークンあたり、オフピークで DeepSeek V4 Flash はキャッシュミス入力 $0.22、キャッシュヒット $0.007、出力 $0.66 です。V4 Pro は順に $0.66、$0.022、$1.98。ピークはどの行もちょうど 2 倍で、Flash が $0.44 / $0.014 / $1.32、Pro が $1.32 / $0.044 / $3.96 になります。2026-08-18 に api-docs.deepseek.com から読み取った値です。
- DeepSeek のピーク時間帯はいつですか?
- UTC 01:00-04:00 と 06:00-10:00 の 1 日あわせて 7 時間、日本時間では 10:00-13:00 と 15:00-19:00 にあたります。それ以外の 17 時間はオフピークで、ピークの半額です。時間帯の境界をまたぐリクエストが開始時刻と終了時刻のどちらで課金されるかは公式に記載がないため、UTC 04:00 と 10:00 付近の長いセッションは未確定です。
- プロンプトキャッシュでどれくらい安くなりますか?
- 同じ段のキャッシュヒットはミスの約 3% なので、入力側でおよそ 97% 引きです。V4 Flash のオフピークなら 100万トークンあたり $0.22 が $0.007 になります。プロンプトの接頭辞がキャッシュに一致すれば自動的に適用され、設定は不要です。
- DeepSeek の API キーはどう取得しますか?
- platform.deepseek.com にメールアドレスで登録し、API Keys からキーを生成します。あるいは ofox.ai を使えば、Claude・GPT・Gemini・Qwen まで 1 本のキーでカバーできます。
- 現在の DeepSeek API はどのモデル ID を受け付けますか?
- deepseek-v4-flash と deepseek-v4-pro です。2026-08-18 時点で料金ページと初回呼び出しページのモデル表にはこの 2 つしかなく、それぞれ DeepSeek-V4-Flash-0731 と DeepSeek-V4-Pro-0813 を指します。旧来の deepseek-chat と deepseek-reasoner はどちらのページにも見当たりません。
- DeepSeek に無料枠はありますか?
- 継続的な無料枠は文書化されていません。課金ルールには、付与残高が入金残高より先に消費されると書かれており、登録時のクレジットはこれで消費されますが、金額や提供の有無は料金ドキュメントのどこにも約束されていません。
- 公式 API とゲートウェイのどちらが安いですか?
- オフピークの時間帯は公式 API のほうが安くなります。ゲートウェイは通常ピークとオフピークの二段構えを再現しないためです。ofox では V4 Flash が終日 入力 $0.44・出力 $1.32 で、これは公式のピーク価格と同額、つまりオフピークの 2 倍にあたります。その差額で買えるのは、1 本のキー、1 通の請求、そして公式プラットフォームが混雑したときの逃げ道です。


