Игорь Градов
Игорь Градов
5 мин
aggregator

Claude 5.1 снизил цену кэша на 75%, но задача подорожала на 20% из-за роста генерации

Claude 5.1 вышла первого сентября 2026 года с контекстным окном в миллион токенов и удешевлённым кэшем, но реальная стоимость задачи при этом выросла на 20% из-за увеличения объёма генерации.

Claude 5.1 снизил цену кэша на 75%, но задача подорожала на 20% из-за роста генерации
Почему это важно

Снижение цены кэш-чтения на 75% выглядит как подарок для агентных сценариев, но модель генерирует в 1,7 раза больше выходных токенов, и итоговый счёт за задачу оказывается выше, чем у предшественника. Экономия на кэше не покрывает рост расходов на генерацию.

Anthropic представила сразу два обновления: Claude Fable 5.1 для кода и длительных автономных задач и Claude Mythos 5.1 для работы со знаниями. По данным Artificial Analysis, независимой аналитической платформы, обе модели могут использовать одни и те же базовые веса (обученные параметры нейросети), а различаются только настройками безопасности и маршрутизации запросов. Anthropic позиционирует релиз не как «лучшую модель по бенчмаркам», а как «автономного работника», достаточно быстрого и совместимого с корпоративными требованиями для реального развёртывания.

Показатель Значение Источник
Контекстное окно 1 000 000 токенов Artificial Analysis
Вход $10 за 1 млн токенов Artificial Analysis
Выход $50 за 1 млн токенов Artificial Analysis
Запись в кэш $12,50 за 1 млн токенов Artificial Analysis
Чтение из кэша $0,25 за 1 млн токенов (снижение на 75%) Artificial Analysis
Artificial Analysis Intelligence Index 66 баллов (максимальное усилие) Artificial Analysis
HLE (оценка знаний) 59,1% (предыдущий лучший результат Fable 5: 55,5%) Artificial Analysis
Terminal-Bench v2.1 91,4% Artificial Analysis
Стоимость задачи Fable 5.1 max $3,76 Artificial Analysis
Рост выходных токенов на задачу примерно в 1,7 раза по сравнению с Fable 5 Artificial Analysis
Итоговый рост стоимости задачи +20% по сравнению с Fable 5 Artificial Analysis

Что измеряли?

Artificial Analysis прогнала Claude 5.1 через собственный набор тестов, который включает несколько направлений. Intelligence Index оценивает общие интеллектуальные способности модели по шкале баллов. HLE проверяет глубину знаний. Terminal-Bench v2.1 тестирует умение модели работать с кодом в терминале, выполняя многоступенчатые задачи.

Отдельно Artificial Analysis замерила стоимость задачи. Здесь «задача» означает типовой агентный сценарий: модель получает длинный контекст (инструкции, код, документацию), многократно перечитывает кэш (сохранённый контекст, чтобы не пересылать его заново), генерирует ответ и при необходимости повторяет цикл.

Именно поэтому важны две цифры одновременно: цена за токен (единицу текста, которую модель читает или пишет) и количество токенов, которое модель тратит на ответ.

Что обнаружили?

  • Claude 5.1 возглавила Intelligence Index с результатом 66 баллов при максимальном усилии. Для сравнения: Claude Opus 5 набрала 63, Claude Fable 5 набрала 62, GPT-5.6 Sol набрала 61, Grok 4.6 набрал 61 (все данные Artificial Analysis).
  • Кэш-чтение подешевело в четыре раза: с $1,00 до $0,25 за миллион токенов. Экономия на одну задачу составляет около $1,40, по данным Artificial Analysis.
  • Модель генерирует в 1,7 раза больше выходных токенов, чем Fable 5 на тех же задачах. Из-за этого итоговая стоимость задачи выросла на 20%: $3,76 у Fable 5.1 max против более низкой стоимости у Fable 5 max.
  • На агентных задачах со знаниями Fable 5.1 фактически идёт вровень с Opus 5 по ряду метрик, а не доминирует над ней. Artificial Analysis подчёркивает, что лидерство проявляется на потолке сложности, но не на каждом соотношении «цена за качество».
  • Около 4% выходных токенов при тестировании Intelligence Index генерировались не самой Fable 5.1, а резервной моделью (Claude Opus 4.8 или Claude Opus 5), на которую сервер перенаправлял запросы, помеченные системой безопасности.
Как это читать

Бенчмарки Artificial Analysis прогонялись с серверным фоллбэком (автоматической подменой модели) Anthropic. Это значит, что 4% ответов дала другая модель, а не Fable 5.1. Сообщество обсуждает, насколько это искажает итоговые баллы. Кроме того, по данным независимого анализа, Fable и Mythos 5.1 могут быть одной моделью с разными фильтрами безопасности, а не двумя отдельными архитектурами. Anthropic это не подтвердила и не опровергла.

Что это значит для вас?

Автору Дзена и копирайтеру. Если вы используете Claude для длинных текстов или многоступенчатой генерации, пересчитайте бюджет. Модель стала умнее, но и «разговорчивее»: на те же задачи уходит в 1,7 раза больше выходных токенов (токен, это минимальная единица текста, которую модель считает и за которую берут деньги). Экономия на кэше не компенсирует рост генерации. Если вы платите через API (программный интерфейс для прямого обращения к модели), проверьте счета за первую неделю.

Маркетологу и менеджеру. Claude 5.1 интересна для автономных агентных цепочек: длинный контекст с дешёвым кэшем подходит для задач, где агент (ИИ-программа, которая сама выполняет последовательность шагов) многократно обращается к одним и тем же данным. Но экономическая модель «дешёвый кэш плюс дорогой выход» требует пересчёта ROI (отдачи на вложения) под конкретный сценарий. Дешевле будет только если ваш агент много читает и мало пишет.

Предпринимателю в РФ и СНГ. Claude доступна через API, но не имеет официального присутствия в России. Из доступных в РФ аналогов: YandexGPT и GigaChat. Если вы уже строите продукт на Claude через прокси или VPN, главный вывод: не закладывайте экономику на основе старых тарифов Fable 5, реальные расходы на задачу выросли.

Мнение редакции dzen.guru

Anthropic сделала ход, который легко прочитать неправильно. Заголовок «кэш подешевел на 75%» создаёт ощущение удешевления. На практике модель стала дороже в расчёте на задачу, это признаёт сама Artificial Analysis. Для тех, кто работает с короткими промптами (запросами к модели) и не использует кэш, ничего не изменилось: цена за вход и выход осталась прежней. Выиграют те, чьи сценарии строятся вокруг повторного чтения длинного контекста при коротких ответах, то есть узкая ниша агентных задач с большой базой знаний. Я бы советовал прогнать свои типичные задачи через калькулятор токенов и сравнить счёт до и после, прежде чем переключаться.

Anthropic выпустила модель, которая лидирует на потолке сложности, но платить за этот потолок придётся больше. Прежде чем мигрировать, откройте биллинг и посчитайте, сколько токенов генерирует ваш реальный сценарий, а не демо из блога.

По данным Artificial Analysis и AINews / Latent Space

Поделиться:TelegramVK
Игорь Градов
Игорь Градов

Основатель dzen.guru. Эксперт по монетизации и продвижению на Дзен. Автор курса «Старт на Дзен 2026».

Комментарии

Читайте также

Open source нейросети меняют GitHub: проекты закрывают пул-реквесты и отдают код ИИ-агентам
aggregator

Open source нейросети меняют GitHub: проекты закрывают пул-реквесты и отдают код ИИ-агентам

Управление открытыми проектами с участием нейросетей меняется прямо сейчас: крупные репозитории на GitHub закрывают входящие пул-реквесты от сообщества и…

6 мин
Генерация видео нейросетью обогнала реальное время: Fal ускорила модель H3 в 35 раз
aggregator

Генерация видео нейросетью обогнала реальное время: Fal ускорила модель H3 в 35 раз

Мне нужно написать новость строго по фактам из оригинала. Давайте разберу ключевые факты: Fal взяла модель Minimax H3 (релиз прошлого месяца) Провела…

5 мин
OpenAI убирает модели из Cursor после покупки редактора SpaceX: дедлайн 12 ноября
aggregator

OpenAI убирает модели из Cursor после покупки редактора SpaceX: дедлайн 12 ноября

OpenAI второго июня объявила, что уберёт свои модели из редактора кода Cursor к 12 ноября, после того как SpaceX Илона Маска купила эту платформу, и назвала…

4 мин