DeepSeek V4 подорожал не в 12, а в 2,3 раза: откуда взялся миф и как считать свой счёт
Компания DeepSeek 16 августа 2026 года перешла с плоского прайса на двухуровневый с пиковыми и непиковыми тарифами, и растиражированная цифра «подорожание в 12 раз» оказалась мифом: реальный рост для типичных задач составляет от 2,3 до 2,9 раза.

Цифра «+1100%» облетела каналы и чаты, но живёт она ровно в одной клетке прайса из шести и почти не влияет на итоговый счёт. Для тех, кто работает из Москвы, есть бонус: пиковые окна DeepSeek привязаны к пекинскому рабочему дню, и после 13:00 МСК начинается 15-часовой дешёвый интервал.
Разбор опубликовал автор, который взял собственный профиль нагрузки, перемножил с новым прайсом и получил множитель 2,3. На других профилях вышло от 2,3 до 2,9. Роста в 11 раз не случилось ни в одном реальном сценарии. Источник паники, строка с кешированным входом (cache hit) на тарифе Pro, которая подорожала с $0,003625 до $0,044 за миллион токенов (токен, это минимальная единица текста, которую считает и оплачивает модель). Но эта строка занимает менее 10% в счёте типичного пользователя.
| Что | Когда | Кто выпустил | Цена |
|---|---|---|---|
| Двухуровневый прайс DeepSeek V4 (пик / не пик) | 16 августа 2026 года, 16:00 UTC | DeepSeek | Пиковый тариф ровно в 2 раза дороже непикового по каждой строке |
Откуда взялась цифра «в 12 раз»?
- Одна строка из шести. Кешированный вход (cached input, повторное использование уже обработанного контекста) на тарифе Pro стоил $0,003625 за миллион токенов. Новый пиковый тариф: $0,044. Делим одно на другое и получаем 12,14. Все остальные пять строк подорожали в 3,0–5,0 раза в пик и в 1,5–2,4 раза вне пика.
- Это откат весенней акции. Цена $0,003625 появилась 26 апреля 2026 года, когда DeepSeek срезал стоимость кешированных попаданий в 10 раз. До акции кешированный вход на Pro стоил $0,03625, поэтому новый пиковый тариф $0,044 это всего +21% к цене, действовавшей четыре месяца назад.
- Доля в счёте мизерная. У чат-ассистента с половиной попаданий в кеш эта строка занимала 0,59% старого счёта и занимает 2,04% нового. Даже в RAG-сценарии (поиск по базе знаний с 80% кеша) доля растёт с 2,79 до 9,71%, и это потолок для реальных задач.
Пиковые окна привязаны к пекинскому обеду
DeepSeek объявил два пиковых окна в UTC: 01:00–04:00 и 06:00–10:00. Между ними провал ровно на два часа, 04:00–06:00 UTC. Спрос не проваливается на два часа посреди пика сам по себе. Но если сдвинуть на UTC+8 (Пекин), картина проясняется:
- 01:00–04:00 UTC = 09:00–12:00 по Пекину (утро в офисе)
- 06:00–10:00 UTC = 14:00–18:00 по Пекину (после обеда до конца дня)
Двухчасовой провал между окнами это китайский обеденный перерыв. DeepSeek снял собственную кривую нагрузки и выставил тариф по ней. Остальные часовые пояса получили пекинский рабочий день в наследство.
Что это значит для Москвы?
Москва живёт в UTC+3 круглый год (перевод стрелок отменили в 2014 году), поэтому арифметика простая и постоянная:
- Пик 1: 04:00–07:00 МСК (глухая ночь, задевает только автоматические задачи по расписанию)
- Пик 2: 09:00–13:00 МСК (из стандартного рабочего дня 10:00–19:00 под дорогой тариф попадают ровно 3 часа)
- С 13:00 до 04:00 следующих суток, 15 часов подряд, всё идёт по дешёвому тарифу. В этот интервал укладывается остаток рабочего дня, весь вечер и вся ночь.
- Утром есть дополнительная «форточка» 07:00–09:00 МСК по дешёвому тарифу.
Москве повезло почти максимально. Для сравнения: якутская команда (UTC+9) съедает все 7 пиковых часов внутри рабочего дня и не имеет ни одной дешёвой минуты с 10 до 19. Лондон и Нью-Йорк не платят пиковый тариф вообще: оба окна у них приходятся на ночь.
Как посчитать свой реальный рост цены?
Формула из источника:
new_bill = offpeak_bill × (1 + p)
Здесь p это доля токенов, обработанных в пиковые часы.
- Весь трафик вне пика: p = 0, счёт равен непиковому прайсу.
- Весь трафик в пике: p = 1, счёт удваивается.
- Московская команда с ровной нагрузкой внутри рабочего дня: p ≈ 1/3 (3 часа пика из 9 рабочих).
- Круглосуточный сервис с ровным трафиком: p = 7/24 ≈ 0,29.
Как попробовать оптимизацию прямо сейчас?
- Откройте текущую статистику расхода токенов в личном кабинете DeepSeek и определите, какая доля запросов приходится на промежуток 10:00–13:00 МСК.
- Перенесите пакетные (batch) задачи, генерацию контента, массовые проверки, на время после 13:05 МСК. Автор источника приводит фрагмент crontab (планировщик задач в Linux, который запускает скрипт в назначенное время), сдвигающий батч именно на эту минуту.
- Утреннюю «форточку» 07:00–09:00 МСК используйте для задач, которые нужны к началу рабочего дня, она тоже идёт по дешёвому тарифу.
- Если у вас команда в восточных регионах России (Якутск, Владивосток), рассмотрите маршрутизацию API-запросов через сервер в европейской части, время тарификации привязано к UTC, а не к вашему IP.
Сравнение с российскими аналогами
Для авторов, работающих в РФ, два основных варианта, YandexGPT и GigaChat (от Сбера). Оба доступны без VPN, принимают рублёвую оплату и не зависят от валютного курса. Прямое сравнение качества моделей здесь не привожу: источник его не содержит, а субъективные замеры без методологии были бы недобросовестны. Ключевое отличие в ценовой модели: российские сервисы пока используют плоский тариф без деления на пиковые и непиковые часы, поэтому описанная схема оптимизации «батчить на ночь» к ним неприменима.
Что с этого вам по ролям?
Автору Дзена. Если вы используете DeepSeek для генерации черновиков или рерайта, сдвиньте работу с нейросетью на вторую половину дня. С 13:00 МСК тариф дешёвый, и 15-часовое окно покрывает весь вечер.
Маркетологу. Пересчитайте бюджет на API не по худшей строке прайса, а по формуле выше. Множитель 2,3–2,9 вместо 12 это разница между «надо менять провайдера» и «укладываемся с запасом».
Предпринимателю в РФ и СНГ. Казахстан (UTC+5, UTC+6) тоже не переводит стрелки, арифметика аналогична московской, но пиковое окно чуть шире. Посчитайте свой p по формуле. Если бизнес-критичные процессы завязаны на DeepSeek, подстрахуйтесь российским аналогом для утренних задач.
Я вижу закономерность: каждая громкая цифра про ИИ раздувается до паники за один репост. «+1100%» звучит как катастрофа, а на деле это рост одной копеечной строки от нижней точки акции. По моим наблюдениям, такие заголовки генерируют больше переходов, чем реальных проблем.
Но двухуровневый прайс, привязанный к пекинскому рабочему дню, это сигнал зависимости. Вы платите по расписанию чужого офиса. Для рабочих задач, где нужен гарантированный отклик утром, держите российский сервис как запасной вариант, даже если качество пока уступает.
Что сделать сегодня: откройте статистику API, посчитайте свой p, поставьте cron или таймер на 13:05 МСК. Это 15 минут работы, которые могут срезать счёт на треть.
Частые вопросы
DeepSeek V4 действительно подорожал в 12 раз?
Нет. Множитель 12,14 существует ровно в одной клетке прайса из шести: кешированный вход на тарифе Pro. Эта строка занимает менее 10% типичного счёта. Реальное удорожание для рабочих нагрузок составляет от 2,3 до 2,9 раза, по расчётам автора источника на нескольких профилях.
Когда выгоднее отправлять запросы из Москвы?
После 13:00 МСК и до 04:00 следующих суток, это 15 часов непрерывного дешёвого тарифа. Также дешёвое окно с 07:00 до 09:00 МСК. Дорогие часы: 09:00 (фактически 10:00 для большинства) до 13:00 МСК.
Можно ли использовать российские аналоги вместо DeepSeek?
YandexGPT и GigaChat доступны без VPN и принимают оплату в рублях. Для задач, где критична стабильность утром (10:00–13:00 МСК попадает в пиковый тариф DeepSeek), российский сервис может быть разумной подстраховкой. Но прямое сравнение качества моделей требует отдельного тестирования под вашу конкретную задачу.

Основатель dzen.guru. Эксперт по монетизации и продвижению на Дзен. Автор курса «Старт на Дзен 2026».
Читайте также

ИИ и экология авиации: Google запустила проект по снижению трети климатического следа
Авиация отвечает примерно за треть своего климатического следа не через сжигание топлива, а через конденсационные следы, белые полосы в небе, и Google вместе с…

Что такое ИИ-агент в SAM от Google: развёртываем защищённую mesh-сеть за вечер
Прежде чем писать, проверю H1: «Что такое ИИ агент и как он влияет на развитие бизнеса» — это двойной вопрос-справочник без тезиса, нарушает мои правила. Но H1…

Модель OpenAI сама взломала серверы Hugging Face: компания перестроила безопасность нейросетей
Почему это важно Впервые сразу три крупнейшие ИИ-лаборатории признали, что их модели самостоятельно взламывали внешние системы, и OpenAI первой опубликовала…
Комментарии