Claude 5.1 снизил цену кэша на 75%, но задача подорожала на 20% из-за роста генерации
Claude 5.1 вышла первого сентября 2026 года с контекстным окном в миллион токенов и удешевлённым кэшем, но реальная стоимость задачи при этом выросла на 20% из-за увеличения объёма генерации.

Снижение цены кэш-чтения на 75% выглядит как подарок для агентных сценариев, но модель генерирует в 1,7 раза больше выходных токенов, и итоговый счёт за задачу оказывается выше, чем у предшественника. Экономия на кэше не покрывает рост расходов на генерацию.
Anthropic представила сразу два обновления: Claude Fable 5.1 для кода и длительных автономных задач и Claude Mythos 5.1 для работы со знаниями. По данным Artificial Analysis, независимой аналитической платформы, обе модели могут использовать одни и те же базовые веса (обученные параметры нейросети), а различаются только настройками безопасности и маршрутизации запросов. Anthropic позиционирует релиз не как «лучшую модель по бенчмаркам», а как «автономного работника», достаточно быстрого и совместимого с корпоративными требованиями для реального развёртывания.
| Показатель | Значение | Источник |
|---|---|---|
| Контекстное окно | 1 000 000 токенов | Artificial Analysis |
| Вход | $10 за 1 млн токенов | Artificial Analysis |
| Выход | $50 за 1 млн токенов | Artificial Analysis |
| Запись в кэш | $12,50 за 1 млн токенов | Artificial Analysis |
| Чтение из кэша | $0,25 за 1 млн токенов (снижение на 75%) | Artificial Analysis |
| Artificial Analysis Intelligence Index | 66 баллов (максимальное усилие) | Artificial Analysis |
| HLE (оценка знаний) | 59,1% (предыдущий лучший результат Fable 5: 55,5%) | Artificial Analysis |
| Terminal-Bench v2.1 | 91,4% | Artificial Analysis |
| Стоимость задачи Fable 5.1 max | $3,76 | Artificial Analysis |
| Рост выходных токенов на задачу | примерно в 1,7 раза по сравнению с Fable 5 | Artificial Analysis |
| Итоговый рост стоимости задачи | +20% по сравнению с Fable 5 | Artificial Analysis |
Что измеряли?
Artificial Analysis прогнала Claude 5.1 через собственный набор тестов, который включает несколько направлений. Intelligence Index оценивает общие интеллектуальные способности модели по шкале баллов. HLE проверяет глубину знаний. Terminal-Bench v2.1 тестирует умение модели работать с кодом в терминале, выполняя многоступенчатые задачи.
Отдельно Artificial Analysis замерила стоимость задачи. Здесь «задача» означает типовой агентный сценарий: модель получает длинный контекст (инструкции, код, документацию), многократно перечитывает кэш (сохранённый контекст, чтобы не пересылать его заново), генерирует ответ и при необходимости повторяет цикл.
Именно поэтому важны две цифры одновременно: цена за токен (единицу текста, которую модель читает или пишет) и количество токенов, которое модель тратит на ответ.
Что обнаружили?
- Claude 5.1 возглавила Intelligence Index с результатом 66 баллов при максимальном усилии. Для сравнения: Claude Opus 5 набрала 63, Claude Fable 5 набрала 62, GPT-5.6 Sol набрала 61, Grok 4.6 набрал 61 (все данные Artificial Analysis).
- Кэш-чтение подешевело в четыре раза: с $1,00 до $0,25 за миллион токенов. Экономия на одну задачу составляет около $1,40, по данным Artificial Analysis.
- Модель генерирует в 1,7 раза больше выходных токенов, чем Fable 5 на тех же задачах. Из-за этого итоговая стоимость задачи выросла на 20%: $3,76 у Fable 5.1 max против более низкой стоимости у Fable 5 max.
- На агентных задачах со знаниями Fable 5.1 фактически идёт вровень с Opus 5 по ряду метрик, а не доминирует над ней. Artificial Analysis подчёркивает, что лидерство проявляется на потолке сложности, но не на каждом соотношении «цена за качество».
- Около 4% выходных токенов при тестировании Intelligence Index генерировались не самой Fable 5.1, а резервной моделью (Claude Opus 4.8 или Claude Opus 5), на которую сервер перенаправлял запросы, помеченные системой безопасности.
Бенчмарки Artificial Analysis прогонялись с серверным фоллбэком (автоматической подменой модели) Anthropic. Это значит, что 4% ответов дала другая модель, а не Fable 5.1. Сообщество обсуждает, насколько это искажает итоговые баллы. Кроме того, по данным независимого анализа, Fable и Mythos 5.1 могут быть одной моделью с разными фильтрами безопасности, а не двумя отдельными архитектурами. Anthropic это не подтвердила и не опровергла.
Что это значит для вас?
Автору Дзена и копирайтеру. Если вы используете Claude для длинных текстов или многоступенчатой генерации, пересчитайте бюджет. Модель стала умнее, но и «разговорчивее»: на те же задачи уходит в 1,7 раза больше выходных токенов (токен, это минимальная единица текста, которую модель считает и за которую берут деньги). Экономия на кэше не компенсирует рост генерации. Если вы платите через API (программный интерфейс для прямого обращения к модели), проверьте счета за первую неделю.
Маркетологу и менеджеру. Claude 5.1 интересна для автономных агентных цепочек: длинный контекст с дешёвым кэшем подходит для задач, где агент (ИИ-программа, которая сама выполняет последовательность шагов) многократно обращается к одним и тем же данным. Но экономическая модель «дешёвый кэш плюс дорогой выход» требует пересчёта ROI (отдачи на вложения) под конкретный сценарий. Дешевле будет только если ваш агент много читает и мало пишет.
Предпринимателю в РФ и СНГ. Claude доступна через API, но не имеет официального присутствия в России. Из доступных в РФ аналогов: YandexGPT и GigaChat. Если вы уже строите продукт на Claude через прокси или VPN, главный вывод: не закладывайте экономику на основе старых тарифов Fable 5, реальные расходы на задачу выросли.
Anthropic сделала ход, который легко прочитать неправильно. Заголовок «кэш подешевел на 75%» создаёт ощущение удешевления. На практике модель стала дороже в расчёте на задачу, это признаёт сама Artificial Analysis. Для тех, кто работает с короткими промптами (запросами к модели) и не использует кэш, ничего не изменилось: цена за вход и выход осталась прежней. Выиграют те, чьи сценарии строятся вокруг повторного чтения длинного контекста при коротких ответах, то есть узкая ниша агентных задач с большой базой знаний. Я бы советовал прогнать свои типичные задачи через калькулятор токенов и сравнить счёт до и после, прежде чем переключаться.
Anthropic выпустила модель, которая лидирует на потолке сложности, но платить за этот потолок придётся больше. Прежде чем мигрировать, откройте биллинг и посчитайте, сколько токенов генерирует ваш реальный сценарий, а не демо из блога.
По данным Artificial Analysis и AINews / Latent Space

Основатель dzen.guru. Эксперт по монетизации и продвижению на Дзен. Автор курса «Старт на Дзен 2026».
Читайте также

Open source нейросети меняют GitHub: проекты закрывают пул-реквесты и отдают код ИИ-агентам
Управление открытыми проектами с участием нейросетей меняется прямо сейчас: крупные репозитории на GitHub закрывают входящие пул-реквесты от сообщества и…

Генерация видео нейросетью обогнала реальное время: Fal ускорила модель H3 в 35 раз
Мне нужно написать новость строго по фактам из оригинала. Давайте разберу ключевые факты: Fal взяла модель Minimax H3 (релиз прошлого месяца) Провела…

OpenAI убирает модели из Cursor после покупки редактора SpaceX: дедлайн 12 ноября
OpenAI второго июня объявила, что уберёт свои модели из редактора кода Cursor к 12 ноября, после того как SpaceX Илона Маска купила эту платформу, и назвала…
Комментарии