DeepSeek ввёл дневной и ночной тариф: насколько выросла цена и что делать бизнесу

18 августа 2026 г.
6 мин
DeepSeek ввёл дневной и ночной тариф: насколько выросла цена и что делать бизнесу

DeepSeek — одна из самых дешёвых моделей на рынке и по этой причине основа для множества чат-ботов, автоответчиков и фоновой обработки текста. 16 августа 2026 года у неё изменился не только уровень цен, но и сам принцип тарификации: теперь стоимость токена зависит от времени суток. Такого раньше не делал ни один крупный поставщик моделей.

Разбираем, что именно изменилось, насколько вырастет счёт и что с этим делать бизнесу, у которого на DeepSeek работают боты и автоматизация.

Что произошло

DeepSeek разделил сутки на «нагруженные» и «ненагруженные» часы. В нагруженные часы токены стоят вдвое дороже, чем в ненагруженные. Плюс поднялась сама базовая цена — она и в дешёвом окне выше того, что было раньше.

Нагруженные часы: 01:00–04:00 и 06:00–10:00 UTC. В московском времени это 04:00–07:00 и 09:00–13:00. Всё остальное время — ненагруженное, то есть вдвое дешевле. Дорогих часов в сутках семь, дешёвых — семнадцать.

Насколько подорожало

Абсолютные тарифы поставщики пересматривают часто, поэтому смотреть на них имеет смысл только в официальной документации DeepSeek. А вот масштаб изменения показателен — вот во сколько раз выросла цена относительно прежней:

Тип токеновНенагруженные часыНагруженные часы
Вход — новый контекстпримерно ×1,5примерно ×3
Выход — ответ моделипримерно ×2,3примерно ×4,6
Вход из кэша×2,5 и вышеот ×5 до ×12

Рост очень неравномерный. Меньше всего подорожал обычный входной текст, сильнее — ответы модели, а больше всего досталось кэшу: до двенадцати раз. Раньше повторно отправленный контекст стоил почти ноль, теперь это заметная строка расходов.

Почему именно эти часы

Разгадка простая: DeepSeek — китайская компания, а Пекин живёт по UTC+8. Нагруженные окна 01:00–04:00 и 06:00–10:00 UTC — это 09:00–12:00 и 14:00–18:00 по Пекину, то есть обычный рабочий день китайского офиса с перерывом на обед. Компания просто перекладывает пик собственной нагрузки на цену.

Для российского бизнеса это выливается в неприятное совпадение. Дорогое окно 09:00–13:00 МСК — это первая половина нашего рабочего дня. Именно тогда клиенты активнее всего пишут в чаты, а боты отвечают чаще всего. Вторая половина дня, вечер и ночь — с 13:00 до 03:00 МСК — наоборот, дешёвые.

Насколько это заметно на практике

Возьмём типового бота первой линии: примерно 4 000 токенов контекста на диалог и 500 токенов ответа. При том же количестве диалогов счёт за модель вырастет примерно в 1,7 раза в дешёвые часы и в 3,5 раза в дорогие.

Честно скажем: в абсолютных деньгах на небольших объёмах это по-прежнему копейки — DeepSeek и после подорожания остаётся одной из самых дешёвых моделей. Заметно станет там, где объём большой: массовая обработка заявок, разбор отзывов, генерация описаний товаров, переиндексация баз знаний. При десятках миллионов токенов в месяц разница между дорогим и дешёвым окном превращается в реальную сумму.

Отдельная категория пострадавших — те, кто выстроил экономию на кэше. Длинный системный промпт, база знаний, большой контекст диалога: всё это кэшируется и раньше почти ничего не стоило. Теперь на этом сэкономить в разы сложнее.

Что делать

1. Разделите задачи на срочные и фоновые. Ответ клиенту в чате подвинуть по времени нельзя — он нужен сейчас, в том числе в дорогие 09:00–13:00. А вот массовые операции откладываются легко: ночная выгрузка, генерация текстов для карточек, разбор накопленных диалогов, переиндексация базы знаний. Перенос таких задач на время после 13:00 МСК сразу режет их стоимость вдвое.

2. Пересчитайте экономику там, где считали на кэше. Если архитектура строилась вокруг «отправим большой контекст, он всё равно закэшируется» — это допущение больше не работает. Возможно, дешевле сократить промпт, чем полагаться на кэш.

3. Проверьте, где у вас вообще стоит DeepSeek. В типовой автоматизации моделей обычно несколько: одна отвечает клиентам, другая классифицирует обращения, третья суммаризирует. Подорожание бьёт по всем сразу, но по каждой по-разному — зависит от соотношения входа и выхода. Сильнее всего выросли выходные токены, поэтому больше подорожают задачи с длинными ответами: генерация текстов, развёрнутые консультации.

4. Не привязывайтесь к одному поставщику. Это главный вывод из всей истории. Ещё вчера DeepSeek была бесспорным выбором «дёшево и достаточно качественно». Сегодня расклад изменился одним объявлением, и часть задач разумнее увести на другие модели. Тот, у кого модель зашита в код намертво, будет переписывать интеграцию. Тот, у кого выбор модели — это настройка, просто поменяет её в списке.

Что это говорит о рынке

Период, когда поставщики моделей соревновались, кто дешевле, заканчивается. Дальше будет больше подобных решений: почасовые тарифы, разные цены за приоритетную и фоновую обработку, отдельная плата за кэш. Мы это уже проходили с облаками и с рекламными аукционами — рынок взрослеет и учится продавать не «токены», а «токены в нужное вам время».

Практический вывод для бизнеса не в том, чтобы угадать самого дешёвого поставщика. Он в том, чтобы не оказаться заложником одного: держать список моделей в настройках, видеть фактический расход и уметь переключиться, когда очередной поставщик поменяет правила. В BotB2B все модели собраны в один каталог, а списание считается по фактическому потреблению — поэтому смена модели под задачу занимает пару кликов, а не спринт разработки.