Игорь Градов
Игорь Градов
7 мин
ai

Цены на нейросети упали до 67% за неделю: как пересчитать реальную экономию

Компания Anthropic снизила цены на модель Claude Opus 5.5 на 20% по прайсу и до 40% на реальных задачах, OpenAI ответила скидками до 67%, а DeepSeek предложила кэшированный вход за 0,003 доллара за миллион токенов (единица текста, которую обрабатывает модель), и всё это произошло 22 сентября с разницей в полтора часа.

Цены на нейросети упали до 67% за неделю: как пересчитать реальную экономию
Почему это важно

Цены на нейросети падают не потому, что подешевело железо: аренда серверов выросла на 15% за год, память прибавила 9% за шесть недель. Экономия идёт за счёт кэширования и моделей, которые тратят меньше токенов на ту же работу, а разницу покрывают инвесторы. Для тех, кто платит за API, это окно возможностей, но с оговорками.

Источник новости, агентство Reuters и публикации самих компаний. Anthropic и OpenAI выпустили модели 22 сентября практически одновременно. Через неделю, 28 и 29 сентября, обе компании добавили ещё по релизу. Фоном стала подготовка Anthropic к IPO (первичное размещение акций) и продолжение ценовой войны, в которой реальная стоимость задачи расходится с прайсом за токен.

Что понадобится

  • Аккаунт в API Anthropic или OpenAI (для прямого доступа к новым ценам)
  • Работающий проект на любой из предыдущих моделей: Claude Opus 5, Sonnet 5 или GPT-5.6
  • Базовое понимание, что такое промпт (текстовый запрос к модели) и токен
  • Примерно 30 минут на аудит текущих затрат и тестовый запуск на новых тарифах

Как пересчитать реальную экономию и перейти на новые цены

  1. Зафиксируйте текущие расходы. Выгрузите статистику за последний месяц: сколько токенов на входе, сколько на выходе, какой процент запросов попадает в кэш. Без этих цифр вы не поймёте, сэкономите ли вообще.

  2. Сравните не цену токена, а цену задачи. По данным Anthropic, Opus 5.5 стоит на 20% дешевле Opus 5 по прайсу (4 доллара за миллион входных и 20 за миллион выходных токенов вместо 5 и 25). Но на типичных нагрузках экономия достигает 40%, потому что модель тратит меньше токенов на ответ. Считать экономику по цене за миллион токенов так же бессмысленно, как сравнивать машины по цене литра бензина, не глядя на расход.

  3. Проверьте, работает ли ваш код с новым API. У Opus 5.5 режим thinking (рассуждение модели «вслух» перед ответом) нельзя выключить: значение disabled возвращает ошибку 400. Глубину рассуждения задаёт только параметр effort. Принудительный выбор инструмента (tool_choice со значениями any и tool) тоже запрещён, работают только auto и none.

# Пример: так было в Opus 5 (работало)
tool_choice: "any"
thinking: "disabled"

# Opus 5.5 — оба вызова вернут ошибку 400
# Правильно:
tool_choice: "auto"
# thinking убирать нельзя, задаём effort:
thinking: { effort: "medium" }
  1. Настройте кэширование. Это главный рычаг экономии. У OpenAI скидка на кэшированный вход достигает 90%, у Anthropic чтение из кэша в Opus 5.5 подешевело в два с половиной раза (0,20 доллара вместо 0,50). OpenAI добавила точки кэширования, предварительный прогрев и дашборд диагностики промахов. Чем длиннее ваш системный промпт (фиксированная инструкция, которая повторяется в каждом запросе) и чем чаще повторяется контекст, тем больше экономия.

  2. Оцените GPT-6 Sol и Luna как альтернативу. GPT-6 Sol стоит 2 доллара за миллион входных и 10 за миллион выходных. GPT-6 Luna ещё дешевле: 0,10 и 0,50 доллара. Против базовых тарифов прошлого GPT-5.6 Sol это минус 60% по входу и минус 67% по выводу. А 29 сентября OpenAI выпустила GPT-6.1 Sol по тем же 2 и 10 долларов, но кэшированный вход подешевел до 0,10, то есть скидка составила 95%. Запись в кэш при этом платная: 2,50 доллара за миллион токенов.

  3. Проверьте Sonnet 5.5, если нужна производительность. 28 сентября Anthropic выпустила Sonnet 5.5 по 2 и 10 долларов за миллион токенов, столько же, сколько стоила Sonnet 5. На тесте Terminal-Bench 4.0 она набрала 70,6% против 66,4% у Opus 5.5. Младшая модель обошла старшую при той же цене.

  4. Не сравнивайте бенчмарки из разных анонсов напрямую. За один месяц в публикациях встречаются Terminal-Bench версий 2.1 и 4.0, OSWorld 2.0 и 2.1, GDPval-AA v2 и v2.1, CursorBench 3.2 и 4.0. Эффективность моделей измеряют на разных уровнях effort. Цифры из разных релизов нельзя ставить рядом, даже если название бенчмарка совпадает.

Как это выглядит на практике

Допустим, ваш ИИ-агент (программа, которая сама выполняет цепочку действий) для обработки клиентских обращений работал на Claude Opus 5. Системный промпт занимает 8 000 токенов и повторяется в каждом из 500 запросов в день. На Opus 5 вы платили 5 долларов за миллион входных токенов, кэш стоил 0,50 доллара. После перехода на Opus 5.5 входной токен стоит 4 доллара, кэшированный 0,20. При хитрейте (доле попаданий в кэш) 80% ваши расходы на вход падают примерно на 45%. А если модель ещё и тратит меньше выходных токенов на каждый ответ, реальная экономия приближается к тем самым 40%, о которых говорит Anthropic.

Частые ошибки

Замена имени модели без проверки API. Opus 5.5 не принимает thinking: "disabled" и жёсткий tool_choice. Если ваш агент построен на принудительном вызове инструмента, после простой замены имени модели он начнёт возвращать ошибки 400. Миграция не сводится к одной строке.

Игнорирование стоимости записи в кэш. OpenAI берёт 2,50 доллара за миллион токенов при записи. Если кэш сбрасывается часто (короткие уникальные сессии), вы заплатите за запись больше, чем сэкономите на чтении.

Перенос бенчмарков между анонсами. 66,4% у Opus 5.5 на Terminal-Bench 4.0 и какое-то число из анонса конкурента на Terminal-Bench 2.1 несопоставимы. Проверяйте версию теста и уровень effort.

Надежда, что цены на нейросети останутся низкими навсегда. По данным Reuters, обязательства Anthropic по облаку и вычислениям на ближайшие годы составляют 518 млрд долларов. Чистый убыток за 2025 год, по проспекту к IPO, около 42 млрд долларов (из них около 34 млрд, неденежное начисление из-за роста оценки). Разницу между дешёвыми токенами и дорогим железом сейчас покрывают инвесторы. Это означает, что текущие цены могут быть временными.

Что делать прямо сейчас, по ролям

Автору Дзена и копирайтеру. Если вы используете Claude или ChatGPT через подписку, цены на нейросети в API вас пока не касаются напрямую. Но если вы работаете через сервисы-посредники (Typingmind, подобные агрегаторы), спросите, обновили ли они тарифы. Экономия до 40% на задачу может означать, что ваш сервис снизит цену или даст больше запросов за те же деньги.

Разработчику и маркетологу. Пересчитайте бюджет на API прямо сейчас. Для ИИ-агентов, RAG-систем (поиск по собственной базе знаний с генерацией ответа) и кодинг-ассистентов главная экономия идёт через кэш, а не через прайс за токен. Настройте дашборд промахов у OpenAI, проверьте хитрейт у Anthropic.

Предпринимателю в РФ и СНГ. Прямой доступ к API Anthropic и OpenAI из России ограничен, приходится работать через прокси или сторонние сервисы. Из доступных в РФ аналогов: YandexGPT и GigaChat, но их ценовая политика строится иначе. Следите, отразятся ли мировые цены на нейросети на стоимости российских сервисов-посредников, которые перепродают доступ к западным моделям.

Мнение редакции dzen.guru

Я вижу здесь классическую гонку за долю рынка, когда компании продают ниже себестоимости, чтобы занять экосистему. Anthropic с обязательствами на 518 млрд долларов и убытком в 42 млрд за год ведёт себя как убыточный маркетплейс на старте. OpenAI со скидками до 95% на кэш делает то же самое. Для пользователей это отличное время: цены на нейросети сейчас субсидированы инвесторами. Но строить бизнес-модель на допущении, что токен всегда будет стоить 0,10 доллара, рискованно. Мой совет: используйте окно, считайте экономию по задаче, а не по токену, и закладывайте в финмодель сценарий, при котором цены вырастут на 30-50% после окончания ценовой войны.

Попробуйте промпт-конструктор dzen.guru

Настройте системный промпт один раз, и кэш начнёт экономить вам деньги с каждым запросом. Наш конструктор поможет собрать промпт, который работает с новыми моделями.

Попробовать бесплатно

Окно дешёвых токенов открыто. Кто первым настроит кэш и пересчитает расход по задаче, тот снимет реальные 40% экономии, а не бумажные 20% из прайс-листа.

Поделиться:TelegramVK
Игорь Градов
Игорь Градов

Основатель dzen.guru. Эксперт по монетизации и продвижению на Дзен. Автор курса «Старт на Дзен 2026».

Комментарии

Читайте также

ChatGPT и психическое здоровье подростков: из 2 000 запросов перерыв предложен дважды
ai

ChatGPT и психическое здоровье подростков: из 2 000 запросов перерыв предложен дважды

ChatGPT получил от крупнейшего американского рейтингового агентства по детскому контенту статус «неприемлемого риска» для подростков, и 3 июня 2025 года…

6 мин
ИИ ПК на Windows 11 с чипами Nvidia: модели работают локально, облако не нужно
ai

ИИ ПК на Windows 11 с чипами Nvidia: модели работают локально, облако не нужно

Почему это важно Впервые Windows-ноутбуки получили чипы Nvidia, рассчитанные на локальный запуск ИИ-моделей без облака, а новая функция изоляции ИИ-агентов…

6 мин
ai

Автоматизация бизнеса с помощью ИИ: менеджер без кода собрал парсер АЗС за час

Компания ChatGPT помогла менеджеру без навыков программирования за час собрать на Python монитор наличия бензина АИ-95 на конкретных АЗС, и теперь инструмент…

5 мин