Цены DeepSeek API 2026: официальные тарифы за млн токенов

Официальные тарифы DeepSeek, снятые с прайс-страницы 2026-08-18: V4 Flash от $0.22 за вход, V4 Pro от $0.66, плюс реальный расчёт кэша и месячного счёта.

Минималистичная визуализация данных на светлом молочном фоне: тёплые янтарные столбцы сравнения цен, абстрактный образ снижения затрат

Обновление от 10 сентября: V4.1 Flash доступна через официальный API. Актуальные тарифы и пример бюджета приведены в руководстве по ценам V4.1 Flash, а переключение Pro 14 сентября — в плане миграции. Текст и FAQ ниже сохраняют исторические сведения о V4 и не описывают текущие цены или доступность V4.1.

Тарифы перепроверены 2026-08-18. Все цифры DeepSeek на этой странице сняты в этот день со страницы цен самой DeepSeek, уже после перехода на тарификацию пик и непик, который вступил в силу 2026-08-16 в 16:00 UTC. Насколько подорожала каждая строка и почему — в разборе Повышение цен DeepSeek API.

DeepSeek V4 Flash стоит $0.22 за миллион входных токенов в непиковые часы и $0.44 в пик, выход — $0.66 и $1.32 соответственно. V4 Pro втрое дороже на входе и выходе и чуть больше чем втрое на попаданиях в кэш. Попадание в кэш обходится примерно в 3% от промаха, и это самый крупный отдельный рычаг в счёте. Пик длится семь часов в сутки, с 01:00 до 04:00 и с 06:00 до 10:00 UTC, а непиковый тариф ровно вдвое ниже. Если вам ближе один ключ на DeepSeek, Claude, GPT и Gemini, чем расписание по часам, ofox.ai отдаёт обе модели по пиковой ставке круглосуточно.

Подключите DeepSeek V4 через ofox.ai одним OpenAI-совместимым ключом.

Что такое DeepSeek V4 Flash?

V4 Flash — это нынешняя объёмная модель DeepSeek, которая продаётся рядом с более сильной V4 Pro. У обеих окно контекста в 1M токенов и до 384K выходных токенов за один ответ. Сегодня в API deepseek-v4-flash указывает на DeepSeek-V4-Flash-0731, а deepseek-v4-pro — на DeepSeek-V4-Pro-0813.

V4 Pro добавляет глубину рассуждения на многошаговых задачах, и тройная цена за токен платится именно за это. V4 Flash закрывает обычную работу: суммаризацию, классификацию, диалог и рутинный код. У обеих моделей режим размышления включён по умолчанию, а как его выключить, описано в отдельном руководстве.

Два идентификатора, которые раньше были в каждом туториале по DeepSeek, deepseek-chat и deepseek-reasoner, на 2026-08-18 отсутствуют в таблице моделей и на странице цен, и на странице первого вызова. Если ваш код всё ещё отправляет их, это стоит проверить, а не считать само собой разумеющимся.

Какие официальные цены у DeepSeek API?

Все значения за миллион токенов, со страницы цен DeepSeek на 2026-08-18. Непиковый тариф ровно вдвое ниже пикового в каждой строке.

МодельВход, попадание в кэшВход, промах кэшаВыходКонтекстМаксимум выхода
deepseek-v4-flash непик$0.007$0.22$0.661M384K
deepseek-v4-flash пик$0.014$0.44$1.321M384K
deepseek-v4-pro непик$0.022$0.66$1.981M384K
deepseek-v4-pro пик$0.044$1.32$3.961M384K

Пик — это 01:00-04:00 и 06:00-10:00 UTC, семь часов в сутки, или 04:00-07:00 и 09:00-13:00 по Москве. Остальные семнадцать часов непиковые. Весь механизм в этом: нет тарифа, который можно выбрать, нет флага, который можно выставить, и нет способа купить непиковую ставку в час пик.

Настоящие деньги лежат в строке кэша. Попадание стоит около 3% от промаха в той же строке, то есть примерно минус 97% на этих токенах, и скидка включается сама, как только префикс вашего промпта совпадает с тем, что у DeepSeek уже есть. Ни настроек, ни отдельного эндпоинта. Всматриваться в эту колонку стоит потому, что боевые промпты в основном и состоят из префикса: системный промпт, схема инструментов, документ, который не меняется между ходами.

Одного в документации нет: по какому времени тарифицируется запрос, начавшийся в непик и закончившийся в пик. Если у вас длинные сессии около 04:00 или 10:00 UTC, это открытый вопрос, а не известный ответ.

Сколько на самом деле выходит за месяц?

Возьмём нагрузку в 10M входных и 2M выходных токенов в месяц на V4 Flash и посчитаем тремя способами.

СценарийНепикПик
Кэш не используется вовсе$3.52$7.04
80% входа обслужено из кэша$1.82$3.63
Тот же объём на V4 Pro, без кэша$10.56$21.12

Разрыв между первыми двумя строками — это аргумент за то, чтобы строить промпты вокруг стабильного префикса. Разрыв между колонками — аргумент за то, чтобы выносить всё пакетное, вроде обработки документов и разметки датасетов, за пределы семи пиковых часов.

В пересчёте на запрос: системный промпт на 2 000 токенов, который каждый раз попадает в кэш, экономит $426 на миллион запросов в непик и $852 в пик по сравнению с оплатой тех же токенов по ставке промаха. Это самая крупная статья, на которую вы влияете, не меняя модель.

Как получить ключ DeepSeek API?

Зарегистрируйтесь на platform.deepseek.com по электронной почте, войдите и создайте ключ в разделе API Keys.

Базовых URL два: https://api.deepseek.com для OpenAI-совместимого маршрута и https://api.deepseek.com/anthropic для Anthropic-совместимого, так что один и тот же ключ работает из любого SDK при смене base_url. JSON-вывод, вызов инструментов, Responses API и продолжение с префиксом поддерживаются на обеих моделях; FIM-дополнение в бете и только в режиме без размышления.

Списание идёт с двух балансов, пополненного и подаренного, причём подаренный расходуется первым, когда есть оба. Постоянный бесплатный тариф нигде не описан, поэтому стартовый кредит стоит считать пробой, а не планом.

Практическая заметка: DeepSeek публикует лимит параллельных запросов, а не обязательство по доступности, и публичной страницы статуса, на которую можно сослаться, нет. Если вы строите что-то продакшен-критичное, продумайте запасной маршрут сами, а не рассчитывайте на запас прочности.

Как обращаться к DeepSeek через ofox?

На ofox.ai модель DeepSeek V4 Flash доступна как deepseek/deepseek-v4-flash-0731 по $0.44 за вход и $1.32 за выход, а DeepSeek V4 Pro — как deepseek/deepseek-v4-pro-0813 по $1.32 и $3.96. Это официальные пиковые ставки, действующие круглосуточно, без деления на пик и непик.

Скажем прямо, потому что вывод работает в обе стороны. В течение семнадцати непиковых часов прямое подключение к DeepSeek обходится вдвое дешевле шлюза. В семь пиковых часов цены совпадают. Шлюз даёт один ключ на все модели, которыми вы пользуетесь, один счёт и место, куда переключиться, когда официальная платформа занята. Если DeepSeek — единственная модель, которую вы вызываете, а задачи пакетные, напрямую дешевле, и в собственном разборе затрат это стоит проговорить вслух.

Ещё одна деталь, важная тем, кому нужен кэш: за одним идентификатором модели может стоять больше одного вышестоящего маршрута, и ставка на чтение кэша у них разная. У V4 Flash на маршрутах DeepSeek и BaiLian чтение кэша тарифицируется по $0.014 за миллион, а на маршруте Azure — по $0.44, то есть по полной цене входа, что означает отсутствие кэш-скидки как таковой. Актуальная разбивка по маршрутам есть на странице модели DeepSeek.

Практическая выгода — один API-ключ, который заодно покрывает Claude, GPT, Gemini, Qwen и остальной каталог, где на 2026-08-18 было больше 130 моделей. Ни отдельных аккаунтов, ни отдельных счетов. Это важно, если вы маршрутизируете между моделями по типу задачи или по стоимости, о чём подробнее в руководстве по агрегации AI API. Если же вам нужен разбор подключения именно из России вместе со сравнением цен, есть отдельный материал: DeepSeek API: подключение из России.

Настройка занимает три строки:

from openai import OpenAI

client = OpenAI(api_key="sk-xxx", base_url="https://api.ofox.run/v1")
response = client.chat.completions.create(
    model="deepseek/deepseek-v4-flash-0731",
    messages=[{"role": "user", "content": "Explain the 1M token context window in one paragraph"}]
)

Если вы переезжаете с OpenAI SDK, руководство по миграции закрывает замену меньше чем за 10 минут.

Как снизить расходы на DeepSeek API?

Скидка за кэш остаётся самым большим рычагом, и она стала больше: когда вход стоил $0.14, попадание экономило $0.137 за миллион токенов, а при непиковых $0.22 экономит $0.213. Стройте промпты так, чтобы системная часть и неизменный контекст шли первыми, потому что именно они чаще всего и кэшируются. Настраивать ничего не нужно, API применяет скидку при совпадении префикса. Почему в реальных счетах доля попаданий обычно ниже проектной, разобрано в расчёте попаданий в кэш.

Второй рычаг появился только что. Вынесите за пределы пикового окна всё, что не обязано выполняться прямо сейчас. Ночная обработка документов, разметка датасетов и массовая суммаризация прекрасно планируются, а непик вдвое дешевле по каждой строке, включая чтение кэша. Семь пиковых часов приходятся на 01:00-04:00 и 06:00-10:00 UTC, поэтому неудобство целиком зависит от вашего часового пояса: команды в Америке в обычный рабочий день почти не задевают его, команды в Восточной Азии попадают в него почти целиком, а по Москве это 04:00-07:00 и 09:00-13:00.

Третий рычаг — выбор модели. Берите deepseek-v4-pro только тогда, когда действительно нужно глубокое рассуждение. Pro стоит ровно втрое дороже Flash на входе с промахом кэша и на выходе, так что классификация, суммаризация и простая генерация на Pro — это тройной счёт без выигрыша.

Подрезка контекста тоже никуда не делась. Окно в 1M большое, но вы платите за каждый входной токен, который не попал в кэш. RAG, который достаёт только релевантные фрагменты, дешевле, чем запихивание документа целиком; этот приём разобран в руководстве по embedding и RAG. Общий свод приёмов по всем моделям — в материале как снизить расходы на AI API.

DeepSeek против альтернатив: как соотносятся цены?

Все цены ниже — ставки ofox на 2026-08-18 за миллион токенов, то есть сравнение идёт из одного источника, а строки DeepSeek взяты по пиковому тарифу, а не по непиковому.

МодельВходВыход
Qwen Max$0.35$1.38
DeepSeek V4 Flash$0.44$1.32
DeepSeek V4 Pro$1.32$3.96
GLM 5.2$1.40$4.40
Claude Sonnet 5$2$10
Kimi K3$3$15
Claude Opus 5$5$25
GPT-5.6 Sol$5$30

V4 Flash дешевле Claude Sonnet 5 в 4.5 раза на входе и в 7.6 раза на выходе, и примерно в 11 раз дешевле Claude Opus 5 или GPT-5.6 Sol по входу. Но самой дешёвой строкой в этом списке он не является: Qwen Max обходит его по входу примерно на 20% и уступает только на выходе. Если кто-то говорит вам, что DeepSeek заведомо самый дешёвый вариант, он давно не проверял.

Компромисс всё тот же. DeepSeek публикует лимит параллельных запросов, а не обязательство по доступности, а следование сложным англоязычным инструкциям бывает слабее, чем у моделей выше. Сравнение по возможностям, а не по цене, есть в руководстве по выбору модели.

Какие ограничения стоит знать до масштабирования?

Несколько вещей, которые больно ударят, если узнать о них поздно:

  • Лимит параллельных запросов задан отдельно для каждой модели, и разрыв немаленький: 2 500 одновременных запросов на V4 Flash против 500 на V4 Pro. Пайплайн, построенный вокруг Pro, упрётся в стену в пять раз раньше.
  • Лимиты частоты зависят от уровня аккаунта, и новые аккаунты стартуют скромно. При нагрузочном тестировании вы их достанете.
  • Контекст в 1M токенов считается только по входу. Максимум выхода — 384K на обеих моделях.
  • Режим размышления включён по умолчанию на обеих моделях, а страница цен отправляет за способом его отключения в отдельное руководство: это не параметр запроса, который можно угадать.
  • FIM-дополнение в бете и работает только в режиме без размышления, на обеих моделях.
  • Цены меняются, и DeepSeek прямо пишет об этом на странице цен: “Product prices may vary and DeepSeek reserves the right to adjust them. We recommend topping up based on your actual usage and regularly checking this page for the most recent pricing information.” После изменения такого масштаба, как 2026-08-16, это не дежурная формулировка.

Итог

При $0.22 за миллион входных токенов в непик и скидке около 97% на закэшированные префиксы DeepSeek V4 Flash остаётся одной из самых дешёвых работоспособных моделей. В августе изменилось то, что счёт теперь зависит от часов: та же задача стоит вдвое дороже между 01:00 и 04:00 или 06:00 и 10:00 UTC. Стройте промпты под попадания в кэш, выносите пакетную работу за эти семь часов и оставляйте V4 Pro тому, чему он действительно нужен.

Подробный разбор реальных затрат на DeepSeek V4 в роли бэкенда для Claude Code, вместе с честной долей попаданий в кэш и компромиссами по качеству, есть в материале стоимость DeepSeek V4 в Claude Code. Что именно даёт V4 Pro 0813 за свою тройную цену, разобрано в обзоре V4 Pro 0813. Начать можно на platform.deepseek.com или через ofox.ai, если нужен один ключ на DeepSeek вместе с Claude, GPT и Gemini.

References

Часто задаваемые вопросы

Сколько стоит DeepSeek API?
За миллион токенов в непиковые часы: у DeepSeek V4 Flash вход при промахе кэша $0.22, при попадании $0.007, выход $0.66. У V4 Pro соответственно $0.66, $0.022 и $1.98. В часы пик каждая строка ровно вдвое дороже: $0.44 / $0.014 / $1.32 у Flash и $1.32 / $0.044 / $3.96 у Pro. Значения сняты с api-docs.deepseek.com 2026-08-18.
Когда у DeepSeek часы пик?
С 01:00 до 04:00 и с 06:00 до 10:00 UTC, всего семь часов в сутки; по московскому времени это 04:00-07:00 и 09:00-13:00. Остальные семнадцать часов идут по половинному тарифу. В документации не сказано, по какому времени считается запрос, пересекающий границу окна, поэтому длинные сессии около 04:00 и 10:00 UTC остаются открытым вопросом.
Сколько экономит кэширование промпта у DeepSeek?
Попадание в кэш стоит около 3% от промаха в той же строке, то есть примерно минус 97% на входных токенах. На V4 Flash в непиковые часы это $0.007 вместо $0.22 за миллион. Скидка применяется автоматически, когда префикс промпта совпадает с уже закэшированным, настраивать ничего не нужно.
Как получить ключ DeepSeek API?
Зарегистрируйтесь на platform.deepseek.com по электронной почте и создайте ключ в разделе API Keys. Либо используйте ofox.ai, чтобы дотянуться до DeepSeek одним ключом, который заодно покрывает Claude, GPT, Gemini и Qwen.
Какие идентификаторы моделей принимает DeepSeek API сегодня?
deepseek-v4-flash и deepseek-v4-pro. На 2026-08-18 только они есть в таблице моделей на странице цен и на странице первого вызова, и указывают на DeepSeek-V4-Flash-0731 и DeepSeek-V4-Pro-0813. Прежние deepseek-chat и deepseek-reasoner там больше не встречаются.
Есть ли у DeepSeek бесплатный тариф?
Постоянный бесплатный тариф нигде не задокументирован. В правилах списания сказано, что подаренный баланс расходуется раньше пополненного, именно так и тратится стартовый кредит, но ни его размер, ни само наличие в документации по ценам не закреплены.
Что дешевле, официальный API или шлюз?
В непиковые часы дешевле официальный API, потому что шлюзы обычно не повторяют деление на пик и непик. На ofox у V4 Flash круглосуточно вход $0.44 и выход $1.32, что равно официальному пиковому тарифу и вдвое выше непикового. За эту разницу вы получаете один ключ, один счёт и запасной маршрут, когда официальная платформа перегружена.