DeepSeek — одна из самых дешёвых моделей на рынке и по этой причине основа для множества чат-ботов, автоответчиков и фоновой обработки текста. 16 августа 2026 года у неё изменился не только уровень цен, но и сам принцип тарификации: теперь стоимость токена зависит от времени суток. Такого раньше не делал ни один крупный поставщик моделей.
Разбираем, что именно изменилось, на сколько вырастет счёт и что с этим делать бизнесу, у которого на DeepSeek работают боты и автоматизация.
Что произошло
DeepSeek разделил сутки на «нагруженные» и «ненагруженные» часы. В нагруженные часы токены стоят вдвое дороже, чем в ненагруженные. Плюс поднялась сама базовая цена — она и в дешёвом окне выше того, что было раньше. Новые правила действуют с 16 августа, 16:00 UTC.
Нагруженные часы: 01:00–04:00 и 06:00–10:00 UTC. В московском времени это 04:00–07:00 и 09:00–13:00. Всё остальное время — ненагруженное, то есть вдвое дешевле. Дорогих часов в сутках семь, дешёвых — семнадцать.
Новые цены
Цены указаны в долларах за 1 млн токенов.
| Модель и тип токенов | Было | Ненагруженные часы | Нагруженные часы |
|---|---|---|---|
| V4 Flash — вход | $0,14 | $0,22 | $0,44 |
| V4 Flash — выход | $0,28 | $0,66 | $1,32 |
| V4 Flash — вход из кэша | $0,0028 | $0,007 | $0,014 |
| V4 Pro — вход | $0,435 | $0,66 | $1,32 |
| V4 Pro — выход | $0,87 | $1,98 | $3,96 |
| V4 Pro — вход из кэша | $0,0036 | $0,022 | $0,044 |
Рост очень неравномерный: от +50% на входных токенах в дешёвом окне до +1100% на кэшированном входе в дорогом. Больше всего подорожал именно кэш — в 5–12 раз. Раньше повторно отправленный контекст стоил почти ноль, теперь это заметная строка расходов.
Почему именно эти часы
Разгадка простая: DeepSeek — китайская компания, а Пекин живёт по UTC+8. Нагруженные окна 01:00–04:00 и 06:00–10:00 UTC — это 09:00–12:00 и 14:00–18:00 по Пекину, то есть обычный рабочий день китайского офиса с перерывом на обед. Компания просто перекладывает пик собственной нагрузки на цену.
Для российского бизнеса это выливается в неприятное совпадение. Дорогое окно 09:00–13:00 МСК — это первая половина нашего рабочего дня. Именно тогда клиенты активнее всего пишут в чаты, а боты отвечают чаще всего. Вторая половина дня, вечер и ночь — с 13:00 до 03:00 МСК — наоборот, дешёвые.
Насколько это заметно на практике
Возьмём типового бота первой линии: примерно 4 000 токенов контекста на диалог и 500 токенов ответа. Тысяча диалогов на V4 Flash:
- Раньше: около $0,70
- В ненагруженные часы: около $1,21
- В нагруженные часы: около $2,42
Честно скажем: в абсолютных деньгах на небольших объёмах это по-прежнему копейки — DeepSeek и после подорожания остаётся одной из самых дешёвых моделей. Заметно станет там, где объём большой: массовая обработка заявок, разбор отзывов, генерация описаний товаров, переиндексация баз знаний. При десятках миллионов токенов в месяц разница между дорогим и дешёвым окном превращается в реальную сумму.
Отдельная категория пострадавших — те, кто выстроил экономию на кэше. Длинный системный промпт, база знаний, большой контекст диалога: всё это кэшируется и раньше почти ничего не стоило. Теперь на этом сэкономить в разы сложнее.
Что делать
1. Разделите задачи на срочные и фоновые. Ответ клиенту в чате подвинуть по времени нельзя — он нужен сейчас, в том числе в дорогие 09:00–13:00. А вот массовые операции откладываются легко: ночная выгрузка, генерация текстов для карточек, разбор накопленных диалогов, переиндексация базы знаний. Перенос таких задач на время после 13:00 МСК сразу режет их стоимость вдвое.
2. Пересчитайте экономику там, где считали на кэше. Если архитектура строилась вокруг «отправим большой контекст, он всё равно закэшируется» — это допущение больше не работает. Возможно, дешевле сократить промпт, чем полагаться на кэш.
3. Проверьте, где у вас вообще стоит DeepSeek. В типовой автоматизации моделей обычно несколько: одна отвечает клиентам, другая классифицирует обращения, третья суммаризирует. Подорожание бьёт по всем сразу, но по каждой по-разному — зависит от соотношения входа и выхода. Больше всего выросли выходные токены, поэтому сильнее подорожают задачи с длинными ответами: генерация текстов, развёрнутые консультации.
4. Не привязывайтесь к одному поставщику. Это главный вывод из всей истории. Ещё вчера DeepSeek была бесспорным выбором «дёшево и достаточно качественно». Сегодня расклад изменился одним объявлением, и часть задач разумнее увести на другие модели. Тот, у кого модель зашита в код намертво, будет переписывать интеграцию. Тот, у кого выбор модели — это настройка, просто поменяет её в списке.
Что это говорит о рынке
Период, когда поставщики моделей соревновались, кто дешевле, заканчивается. Дальше будет больше подобных решений: почасовые тарифы, разные цены за приоритетную и фоновую обработку, отдельная плата за кэш. Мы это уже проходили с облаками и с рекламными аукционами — рынок взрослеет и учится продавать не «токены», а «токены в нужное вам время».
Практический вывод для бизнеса не в том, чтобы угадать самого дешёвого поставщика. Он в том, чтобы не оказаться заложником одного: держать список моделей в настройках, видеть фактический расход и уметь переключиться, когда очередной поставщик поменяет правила. В BotB2B все модели собраны в один каталог, а списание считается по фактическому потреблению — поэтому смена модели под задачу занимает пару кликов, а не спринт разработки.