Цены на нейросети упали до 67% за неделю: как пересчитать реальную экономию
Компания Anthropic снизила цены на модель Claude Opus 5.5 на 20% по прайсу и до 40% на реальных задачах, OpenAI ответила скидками до 67%, а DeepSeek предложила кэшированный вход за 0,003 доллара за миллион токенов (единица текста, которую обрабатывает модель), и всё это произошло 22 сентября с разницей в полтора часа.

Цены на нейросети падают не потому, что подешевело железо: аренда серверов выросла на 15% за год, память прибавила 9% за шесть недель. Экономия идёт за счёт кэширования и моделей, которые тратят меньше токенов на ту же работу, а разницу покрывают инвесторы. Для тех, кто платит за API, это окно возможностей, но с оговорками.
Источник новости, агентство Reuters и публикации самих компаний. Anthropic и OpenAI выпустили модели 22 сентября практически одновременно. Через неделю, 28 и 29 сентября, обе компании добавили ещё по релизу. Фоном стала подготовка Anthropic к IPO (первичное размещение акций) и продолжение ценовой войны, в которой реальная стоимость задачи расходится с прайсом за токен.
Что понадобится
- Аккаунт в API Anthropic или OpenAI (для прямого доступа к новым ценам)
- Работающий проект на любой из предыдущих моделей: Claude Opus 5, Sonnet 5 или GPT-5.6
- Базовое понимание, что такое промпт (текстовый запрос к модели) и токен
- Примерно 30 минут на аудит текущих затрат и тестовый запуск на новых тарифах
Как пересчитать реальную экономию и перейти на новые цены
-
Зафиксируйте текущие расходы. Выгрузите статистику за последний месяц: сколько токенов на входе, сколько на выходе, какой процент запросов попадает в кэш. Без этих цифр вы не поймёте, сэкономите ли вообще.
-
Сравните не цену токена, а цену задачи. По данным Anthropic, Opus 5.5 стоит на 20% дешевле Opus 5 по прайсу (4 доллара за миллион входных и 20 за миллион выходных токенов вместо 5 и 25). Но на типичных нагрузках экономия достигает 40%, потому что модель тратит меньше токенов на ответ. Считать экономику по цене за миллион токенов так же бессмысленно, как сравнивать машины по цене литра бензина, не глядя на расход.
-
Проверьте, работает ли ваш код с новым API. У Opus 5.5 режим thinking (рассуждение модели «вслух» перед ответом) нельзя выключить: значение
disabledвозвращает ошибку 400. Глубину рассуждения задаёт только параметрeffort. Принудительный выбор инструмента (tool_choiceсо значениямиanyиtool) тоже запрещён, работают толькоautoиnone.
# Пример: так было в Opus 5 (работало)
tool_choice: "any"
thinking: "disabled"
# Opus 5.5 — оба вызова вернут ошибку 400
# Правильно:
tool_choice: "auto"
# thinking убирать нельзя, задаём effort:
thinking: { effort: "medium" }
-
Настройте кэширование. Это главный рычаг экономии. У OpenAI скидка на кэшированный вход достигает 90%, у Anthropic чтение из кэша в Opus 5.5 подешевело в два с половиной раза (0,20 доллара вместо 0,50). OpenAI добавила точки кэширования, предварительный прогрев и дашборд диагностики промахов. Чем длиннее ваш системный промпт (фиксированная инструкция, которая повторяется в каждом запросе) и чем чаще повторяется контекст, тем больше экономия.
-
Оцените GPT-6 Sol и Luna как альтернативу. GPT-6 Sol стоит 2 доллара за миллион входных и 10 за миллион выходных. GPT-6 Luna ещё дешевле: 0,10 и 0,50 доллара. Против базовых тарифов прошлого GPT-5.6 Sol это минус 60% по входу и минус 67% по выводу. А 29 сентября OpenAI выпустила GPT-6.1 Sol по тем же 2 и 10 долларов, но кэшированный вход подешевел до 0,10, то есть скидка составила 95%. Запись в кэш при этом платная: 2,50 доллара за миллион токенов.
-
Проверьте Sonnet 5.5, если нужна производительность. 28 сентября Anthropic выпустила Sonnet 5.5 по 2 и 10 долларов за миллион токенов, столько же, сколько стоила Sonnet 5. На тесте Terminal-Bench 4.0 она набрала 70,6% против 66,4% у Opus 5.5. Младшая модель обошла старшую при той же цене.
-
Не сравнивайте бенчмарки из разных анонсов напрямую. За один месяц в публикациях встречаются Terminal-Bench версий 2.1 и 4.0, OSWorld 2.0 и 2.1, GDPval-AA v2 и v2.1, CursorBench 3.2 и 4.0. Эффективность моделей измеряют на разных уровнях effort. Цифры из разных релизов нельзя ставить рядом, даже если название бенчмарка совпадает.
Допустим, ваш ИИ-агент (программа, которая сама выполняет цепочку действий) для обработки клиентских обращений работал на Claude Opus 5. Системный промпт занимает 8 000 токенов и повторяется в каждом из 500 запросов в день. На Opus 5 вы платили 5 долларов за миллион входных токенов, кэш стоил 0,50 доллара. После перехода на Opus 5.5 входной токен стоит 4 доллара, кэшированный 0,20. При хитрейте (доле попаданий в кэш) 80% ваши расходы на вход падают примерно на 45%. А если модель ещё и тратит меньше выходных токенов на каждый ответ, реальная экономия приближается к тем самым 40%, о которых говорит Anthropic.
Замена имени модели без проверки API. Opus 5.5 не принимает thinking: "disabled" и жёсткий tool_choice. Если ваш агент построен на принудительном вызове инструмента, после простой замены имени модели он начнёт возвращать ошибки 400. Миграция не сводится к одной строке.
Игнорирование стоимости записи в кэш. OpenAI берёт 2,50 доллара за миллион токенов при записи. Если кэш сбрасывается часто (короткие уникальные сессии), вы заплатите за запись больше, чем сэкономите на чтении.
Перенос бенчмарков между анонсами. 66,4% у Opus 5.5 на Terminal-Bench 4.0 и какое-то число из анонса конкурента на Terminal-Bench 2.1 несопоставимы. Проверяйте версию теста и уровень effort.
Надежда, что цены на нейросети останутся низкими навсегда. По данным Reuters, обязательства Anthropic по облаку и вычислениям на ближайшие годы составляют 518 млрд долларов. Чистый убыток за 2025 год, по проспекту к IPO, около 42 млрд долларов (из них около 34 млрд, неденежное начисление из-за роста оценки). Разницу между дешёвыми токенами и дорогим железом сейчас покрывают инвесторы. Это означает, что текущие цены могут быть временными.
Что делать прямо сейчас, по ролям
Автору Дзена и копирайтеру. Если вы используете Claude или ChatGPT через подписку, цены на нейросети в API вас пока не касаются напрямую. Но если вы работаете через сервисы-посредники (Typingmind, подобные агрегаторы), спросите, обновили ли они тарифы. Экономия до 40% на задачу может означать, что ваш сервис снизит цену или даст больше запросов за те же деньги.
Разработчику и маркетологу. Пересчитайте бюджет на API прямо сейчас. Для ИИ-агентов, RAG-систем (поиск по собственной базе знаний с генерацией ответа) и кодинг-ассистентов главная экономия идёт через кэш, а не через прайс за токен. Настройте дашборд промахов у OpenAI, проверьте хитрейт у Anthropic.
Предпринимателю в РФ и СНГ. Прямой доступ к API Anthropic и OpenAI из России ограничен, приходится работать через прокси или сторонние сервисы. Из доступных в РФ аналогов: YandexGPT и GigaChat, но их ценовая политика строится иначе. Следите, отразятся ли мировые цены на нейросети на стоимости российских сервисов-посредников, которые перепродают доступ к западным моделям.
Я вижу здесь классическую гонку за долю рынка, когда компании продают ниже себестоимости, чтобы занять экосистему. Anthropic с обязательствами на 518 млрд долларов и убытком в 42 млрд за год ведёт себя как убыточный маркетплейс на старте. OpenAI со скидками до 95% на кэш делает то же самое. Для пользователей это отличное время: цены на нейросети сейчас субсидированы инвесторами. Но строить бизнес-модель на допущении, что токен всегда будет стоить 0,10 доллара, рискованно. Мой совет: используйте окно, считайте экономию по задаче, а не по токену, и закладывайте в финмодель сценарий, при котором цены вырастут на 30-50% после окончания ценовой войны.
Попробуйте промпт-конструктор dzen.guru
Настройте системный промпт один раз, и кэш начнёт экономить вам деньги с каждым запросом. Наш конструктор поможет собрать промпт, который работает с новыми моделями.
Попробовать бесплатноОкно дешёвых токенов открыто. Кто первым настроит кэш и пересчитает расход по задаче, тот снимет реальные 40% экономии, а не бумажные 20% из прайс-листа.

Основатель dzen.guru. Эксперт по монетизации и продвижению на Дзен. Автор курса «Старт на Дзен 2026».
Читайте также

ChatGPT и психическое здоровье подростков: из 2 000 запросов перерыв предложен дважды
ChatGPT получил от крупнейшего американского рейтингового агентства по детскому контенту статус «неприемлемого риска» для подростков, и 3 июня 2025 года…

ИИ ПК на Windows 11 с чипами Nvidia: модели работают локально, облако не нужно
Почему это важно Впервые Windows-ноутбуки получили чипы Nvidia, рассчитанные на локальный запуск ИИ-моделей без облака, а новая функция изоляции ИИ-агентов…
Автоматизация бизнеса с помощью ИИ: менеджер без кода собрал парсер АЗС за час
Компания ChatGPT помогла менеджеру без навыков программирования за час собрать на Python монитор наличия бензина АИ-95 на конкретных АЗС, и теперь инструмент…
Комментарии