Китайская компания DeepSeek объявила о пересмотре тарифов на программный доступ к своим языковым моделям. Новые ставки вступают в силу 16 августа 2026 года в 16:00 UTC — это 19:00 по московскому времени того же дня. Изменение затрагивает обе актуальные модели линейки: V4-Flash и V4-Pro.
Главное новшество — отказ от единой круглосуточной ставки. Вместо неё вводится разделение на часы повышенной нагрузки и всё остальное время, причём разница между ними ровно двукратная.
Что именно меняется
Периодами повышенной нагрузки объявлены два окна: 01:00–04:00 и 06:00–10:00 UTC. По московскому времени это 04:00–07:00 и 09:00–13:00. Все остальные часы считаются обычными. Суммарно повышенный тариф действует 7 часов из 24, то есть около 29% суток.
Рублёвые значения ниже приводятся справочно, по курсу Банка России на 14 августа 2026 года — 83,81 рубля за доллар. Все цены указаны за 1 млн токенов.
Напомним, что вход у DeepSeek делится на две ставки. Если начало запроса совпадает с уже обработанным ранее фрагментом, эта часть тарифицируется по льготной цене — попадание в кэш. Всё новое считается по полной ставке — промах. Кэширование включено по умолчанию и не требует изменений в коде.
Насколько подорожал V4-Flash
До объявления младшая модель стоила $0,0028 / $0,14 / $0,28 за миллион токенов — попадание в кэш, промах и выход соответственно. Одна ставка, круглые сутки. Сравнение с новой сеткой даёт следующую картину:
Обращает на себя внимание неравномерность повышения. Сильнее всего подорожал именно тот тариф, который считался главным преимуществом DeepSeek — льготная ставка на повторно используемый ввод. Разрыв между попаданием и промахом сократился примерно с 50-кратного до 31-кратного. Экономия на продуманной структуре запроса остаётся значительной, но её относительный вес снизился.
V4-Pro: рекордные 1100%
Старшая модель до пересмотра стоила $0,003625 / $0,435 / $0,87. Именно на ней зафиксирован самый заметный скачок:
- Вход с попаданием в кэш: с $0,003625 (0,30 ₽) до $0,022 — 1,84 ₽ в обычные часы (рост в 6 раз) и до $0,044 — 3,69 ₽ в часы нагрузки, что означает увеличение более чем на 1100%.
- Вход с промахом: с $0,435 (36,5 ₽) до $0,66 (55,3 ₽) и $1,32 (110,6 ₽) — рост в 1,5 и 3 раза.
- Выход: с $0,87 (72,9 ₽) до $1,98 (165,9 ₽) и $3,96 (331,9 ₽) — рост в 2,3 и 4,6 раза.
Именно цифра в 1100%, относящаяся к одной конкретной позиции старшей модели, разошлась по заголовкам новостных агентств. К V4-Flash она отношения не имеет — младшая модель отделалась заметно легче.
Как это отразится на счетах
Возьмём простой ориентир: обработка 1 млн входных токенов без кэширования плюс 1 млн выходных.
Если запросы распределены по суткам равномерно, средневзвешенный рост составит примерно двукратный по входу и трёхкратный по выходу. Тот, кто сумеет вывести пакетные задачи за пределы двух пиковых окон, отделается ростом в два с небольшим раза. Тот, чья нагрузка привязана к рабочему дню, получит счёт ближе к верхней границе — окно 09:00–13:00 МСК приходится ровно на первую половину рабочего дня.
Отдельного внимания заслуживает режим рассуждений. Он включён по умолчанию, а порождаемые им служебные токены тарифицируются по ставке выхода — той самой, которая подорожала сильнее всего. Для длинных агентских сценариев это может оказаться основной статьёй расходов.
Положение на фоне конкурентов
До пересмотра V4-Flash занимал позицию самого дешёвого серьёзного интерфейса на рынке. После 16 августа расстановка сил меняется. В бюджетном сегменте расклад теперь такой:
Вывод неутешительный для DeepSeek: в часы повышенной нагрузки V4-Flash перестаёт быть самым дешёвым вариантом по вводу и уступает младшим моделям Google более чем вчетверо. По выводу преимущество сохраняется, но уже не подавляющее.
В старшем сегменте позиции пока прочнее. Даже в часы нагрузки V4-Pro ($1,32 / $3,96, или 110,6 / 331,9 ₽) остаётся дешевле Gemini 3.1 Pro ($2 / $12), Claude Sonnet 5 ($3 / $15), Kimi K3 ($3 / $15), Claude Opus 4.8 ($5 / $25) и GPT-5.6 Sol ($5 / $30). А вот с GLM-5.2 от Zhipu ($1,40 / $4,40) разрыв практически исчез — китайские разработчики сблизились по ценам между собой.
Стоит помнить и об альтернативных площадках. Модели DeepSeek распространяются с открытыми весами, и их размещают сторонние поставщики вычислений. У них собственные тарифы, не зависящие от решения самой компании, — правда, и льготные ставки на повторный ввод там, как правило, заметно хуже. Точка безубыточности между собственным интерфейсом DeepSeek и сторонней площадкой определяется долей попаданий в кэш: чем она выше, тем выгоднее оставаться у первоисточника.
Что можно предпринять
- Перенести отложенные задачи. Регулярная обработка, массовая разметка, переиндексация — всё, что не требует немедленного ответа, стоит сдвинуть за пределы окон 04:00–07:00 и 09:00–13:00 МСК. Это ровно двукратная экономия при нулевых изменениях в коде.
- Проверить режим рассуждений. Если задача не требует пошагового вывода, отключение режима убирает существенную долю выходных токенов.
- Пересобрать структуру запросов. Постоянная часть — системная инструкция, справочные документы, примеры — идёт в начало, изменяемая в конец. Так растёт доля попаданий в кэш.
- Сравнить с младшими моделями конкурентов. Для простых задач вроде классификации, извлечения полей и коротких пересказов бюджетные модели Google после 16 августа выглядят предпочтительнее по цене.
- Заложить запас в бюджет. Компания оставляет за собой право корректировать тарифы, а уведомление о готовящемся повышении публиковалось ещё в начале августа без конкретных цифр.
Общая тенденция читается однозначно: эпоха, когда доступ к сильной языковой модели стоил символических денег, подходит к концу. Раздельные тарифы по времени суток — механизм, знакомый по энергетике и облачным вычислениям, — приходит и в этот рынок. Стоимость вывода токенов на массовых моделях за один шаг выросла в два-пять раз, и следующие пересмотры тарифов, судя по всему, будут идти в ту же сторону.















