Китайская компания DeepSeek объявила о пересмотре тарифов на программный доступ к своим языковым моделям. Новые ставки вступают в силу 16 августа 2026 года в 16:00 UTC — это 19:00 по московскому времени того же дня. Изменение затрагивает обе актуальные модели линейки: V4-Flash и V4-Pro.

DeepSeek V4 API New Pricing DeepSeek V4 API New Pricing

Главное новшество — отказ от единой круглосуточной ставки. Вместо неё вводится разделение на часы повышенной нагрузки и всё остальное время, причём разница между ними ровно двукратная.

Что именно меняется

Периодами повышенной нагрузки объявлены два окна: 01:00–04:00 и 06:00–10:00 UTC. По московскому времени это 04:00–07:00 и 09:00–13:00. Все остальные часы считаются обычными. Суммарно повышенный тариф действует 7 часов из 24, то есть около 29% суток.

Рублёвые значения ниже приводятся справочно, по курсу Банка России на 14 августа 2026 года — 83,81 рубля за доллар. Все цены указаны за 1 млн токенов.

Модель и период
Вход (попадание в кэш)
Вход (промах)
Выход
V4-Flash, обычные часы
$0,007 — 0,59 ₽
$0,22 — 18,4 ₽
$0,66 — 55,3 ₽
V4-Flash, часы нагрузки
$0,014 — 1,17 ₽
$0,44 — 36,9 ₽
$1,32 — 110,6 ₽
V4-Pro, обычные часы
$0,022 — 1,84 ₽
$0,66 — 55,3 ₽
$1,98 — 165,9 ₽
V4-Pro, часы нагрузки
$0,044 — 3,69 ₽
$1,32 — 110,6 ₽
$3,96 — 331,9 ₽

Напомним, что вход у DeepSeek делится на две ставки. Если начало запроса совпадает с уже обработанным ранее фрагментом, эта часть тарифицируется по льготной цене — попадание в кэш. Всё новое считается по полной ставке — промах. Кэширование включено по умолчанию и не требует изменений в коде.

реклама кормит Уточку 🦆

Насколько подорожал V4-Flash

До объявления младшая модель стоила $0,0028 / $0,14 / $0,28 за миллион токенов — попадание в кэш, промах и выход соответственно. Одна ставка, круглые сутки. Сравнение с новой сеткой даёт следующую картину:

Позиция
Было
Обычные часы
Часы нагрузки
Вход, попадание в кэш
$0,0028 — 0,23 ₽
$0,007 — 0,59 ₽ (×2,5)
$0,014 — 1,17 ₽ (×5,0)
Вход, промах
$0,14 — 11,7 ₽
$0,22 — 18,4 ₽ (×1,6)
$0,44 — 36,9 ₽ (×3,1)
Выход
$0,28 — 23,5 ₽
$0,66 — 55,3 ₽ (×2,4)
$1,32 — 110,6 ₽ (×4,7)

Обращает на себя внимание неравномерность повышения. Сильнее всего подорожал именно тот тариф, который считался главным преимуществом DeepSeek — льготная ставка на повторно используемый ввод. Разрыв между попаданием и промахом сократился примерно с 50-кратного до 31-кратного. Экономия на продуманной структуре запроса остаётся значительной, но её относительный вес снизился.

V4-Pro: рекордные 1100%

Старшая модель до пересмотра стоила $0,003625 / $0,435 / $0,87. Именно на ней зафиксирован самый заметный скачок:

  • Вход с попаданием в кэш: с $0,003625 (0,30 ₽) до $0,022 — 1,84 ₽ в обычные часы (рост в 6 раз) и до $0,044 — 3,69 ₽ в часы нагрузки, что означает увеличение более чем на 1100%.
  • Вход с промахом: с $0,435 (36,5 ₽) до $0,66 (55,3 ₽) и $1,32 (110,6 ₽) — рост в 1,5 и 3 раза.
  • Выход: с $0,87 (72,9 ₽) до $1,98 (165,9 ₽) и $3,96 (331,9 ₽) — рост в 2,3 и 4,6 раза.

Именно цифра в 1100%, относящаяся к одной конкретной позиции старшей модели, разошлась по заголовкам новостных агентств. К V4-Flash она отношения не имеет — младшая модель отделалась заметно легче.

реклама кормит Уточку 🦆

Как это отразится на счетах

Возьмём простой ориентир: обработка 1 млн входных токенов без кэширования плюс 1 млн выходных.

Модель
Было
Обычные часы
Часы нагрузки
V4-Flash
$0,42 — 35,2 ₽
$0,88 — 73,7 ₽
$1,76 — 147,5 ₽
V4-Pro
$1,31 — 109,4 ₽
$2,64 — 221,3 ₽
$5,28 — 442,5 ₽

Если запросы распределены по суткам равномерно, средневзвешенный рост составит примерно двукратный по входу и трёхкратный по выходу. Тот, кто сумеет вывести пакетные задачи за пределы двух пиковых окон, отделается ростом в два с небольшим раза. Тот, чья нагрузка привязана к рабочему дню, получит счёт ближе к верхней границе — окно 09:00–13:00 МСК приходится ровно на первую половину рабочего дня.

Отдельного внимания заслуживает режим рассуждений. Он включён по умолчанию, а порождаемые им служебные токены тарифицируются по ставке выхода — той самой, которая подорожала сильнее всего. Для длинных агентских сценариев это может оказаться основной статьёй расходов.

Положение на фоне конкурентов

До пересмотра V4-Flash занимал позицию самого дешёвого серьёзного интерфейса на рынке. После 16 августа расстановка сил меняется. В бюджетном сегменте расклад теперь такой:

Модель
Вход
Выход
Gemini 2.5 Flash-Lite
$0,10 — 8,4 ₽
$0,40 — 33,5 ₽
GPT-5.6 Luna
$0,20 — 16,8 ₽
$1,20 — 100,6 ₽
DeepSeek V4-Flash, обычные часы
$0,22 — 18,4 ₽
$0,66 — 55,3 ₽
Gemini 3.1 Flash-Lite
$0,25 — 21,0 ₽
$1,50 — 125,7 ₽
Gemini 3.5 Flash-Lite
$0,30 — 25,1 ₽
$2,50 — 209,5 ₽
DeepSeek V4-Flash, часы нагрузки
$0,44 — 36,9 ₽
$1,32 — 110,6 ₽
MiniMax M3
$0,60 — 50,3 ₽
$2,40 — 201,1 ₽
Claude Haiku 4.5
$1,00 — 83,8 ₽
$5,00 — 419,1 ₽

Вывод неутешительный для DeepSeek: в часы повышенной нагрузки V4-Flash перестаёт быть самым дешёвым вариантом по вводу и уступает младшим моделям Google более чем вчетверо. По выводу преимущество сохраняется, но уже не подавляющее.

реклама кормит Уточку 🦆

В старшем сегменте позиции пока прочнее. Даже в часы нагрузки V4-Pro ($1,32 / $3,96, или 110,6 / 331,9 ₽) остаётся дешевле Gemini 3.1 Pro ($2 / $12), Claude Sonnet 5 ($3 / $15), Kimi K3 ($3 / $15), Claude Opus 4.8 ($5 / $25) и GPT-5.6 Sol ($5 / $30). А вот с GLM-5.2 от Zhipu ($1,40 / $4,40) разрыв практически исчез — китайские разработчики сблизились по ценам между собой.

Стоит помнить и об альтернативных площадках. Модели DeepSeek распространяются с открытыми весами, и их размещают сторонние поставщики вычислений. У них собственные тарифы, не зависящие от решения самой компании, — правда, и льготные ставки на повторный ввод там, как правило, заметно хуже. Точка безубыточности между собственным интерфейсом DeepSeek и сторонней площадкой определяется долей попаданий в кэш: чем она выше, тем выгоднее оставаться у первоисточника.

Что можно предпринять

  • Перенести отложенные задачи. Регулярная обработка, массовая разметка, переиндексация — всё, что не требует немедленного ответа, стоит сдвинуть за пределы окон 04:00–07:00 и 09:00–13:00 МСК. Это ровно двукратная экономия при нулевых изменениях в коде.
  • Проверить режим рассуждений. Если задача не требует пошагового вывода, отключение режима убирает существенную долю выходных токенов.
  • Пересобрать структуру запросов. Постоянная часть — системная инструкция, справочные документы, примеры — идёт в начало, изменяемая в конец. Так растёт доля попаданий в кэш.
  • Сравнить с младшими моделями конкурентов. Для простых задач вроде классификации, извлечения полей и коротких пересказов бюджетные модели Google после 16 августа выглядят предпочтительнее по цене.
  • Заложить запас в бюджет. Компания оставляет за собой право корректировать тарифы, а уведомление о готовящемся повышении публиковалось ещё в начале августа без конкретных цифр.

Общая тенденция читается однозначно: эпоха, когда доступ к сильной языковой модели стоил символических денег, подходит к концу. Раздельные тарифы по времени суток — механизм, знакомый по энергетике и облачным вычислениям, — приходит и в этот рынок. Стоимость вывода токенов на массовых моделях за один шаг выросла в два-пять раз, и следующие пересмотры тарифов, судя по всему, будут идти в ту же сторону.