Claude 5.1 снизил стоимость кэш-токенов на 75%, но сломал три точки API
Anthropic выпустила Claude Fable 5.1 и Claude Mythos 5.1 спустя три месяца после линейки Fable 5, снизив стоимость кэш-токенов на 75% и удвоив результат на научном бенчмарке, но добавив три изменения API, которые сломают существующий код.

Кэш-чтение подешевело с $1.00 до $0.25 за миллион токенов (токен, минимальная единица текста, которую обрабатывает модель). Для тех, кто строит агентные сценарии и RAG-системы (поиск по собственной базе знаний с подстановкой найденного в промпт), экономия на типичных задачах составляет около 25%, а на агентных, до 45%. Но три изменения в API ломают обратную совместимость, и это требует действий до обновления.
Marktechpost сообщает, что обе модели вышли в сентябре 2026 года. Fable 5.1 и Mythos 5.1 построены на одной и той же базовой модели, но различаются уровнями защитных фильтров: Fable 5.1 доступна всем через API, а Mythos 5.1 ограничена проверенными организациями в США в проекте Glasswing. Обе поддерживают контекстное окно в 1 миллион токенов и до 128 тысяч токенов на выходе, с постоянно включённым адаптивным мышлением.
| Что | Когда | Кто выпустил | Цена |
|---|---|---|---|
| Claude Fable 5.1 (общедоступная) | Сентябрь 2026, через 3 месяца после Fable 5 | Anthropic | Вход: $10, выход: $50 за млн токенов (без изменений). Кэш-чтение: $0.25 за млн (было $1.00) |
| Claude Mythos 5.1 (ограниченная) | Тот же период | Anthropic | Доступ только для проверенных организаций США |
Что изменилось в Claude 5.1?
-
Научный бенчмарк удвоился. На Terminal-Bench-Science 0.1 (агентный бенчмарк для научных исследований) Fable 5.1 набрала 52.6% против 24.7% у Fable 5 и 29.0% у Opus 5. Для сравнения: GPT-5.6 Sol показала 22.4%. Anthropic указывает стандартную ошибку от 3.5 до 4.5 пунктов на модель, поэтому важен разрыв, а не точное место в рейтинге.
-
Кэш-чтение подешевело на 75%. Было $1.00 за миллион токенов, стало $0.25. Базовые цены на вход ($10) и выход ($50) не изменились. Пакетная обработка стоит $5 и $25 за миллион токенов соответственно.
-
Защитные фильтры стали точнее. Кибербезопасность теперь разрешает обнаружение уязвимостей, но блокирует создание эксплойтов. Количество ложных срабатываний в Claude Code сократилось примерно на 60% за сессию. Биологические фильтры срабатывают на 85% реже на безобидных запросах.
-
Mythos 5.1 показала научные результаты. По данным Anthropic: белковые связыватели с примерно 50% попаданием по 12 мишеням (норма от 10 до 15%), карта высот Венеры с разрешением от 2 до 3 км, ускорение семи геномных моделей с открытым кодом до 2.5 раз с помощью кастомных GPU-ядер.
-
Есть честно задокументированные регрессии. Параллельный вызов инструментов стал менее стабильным: агентные циклы могут выполнять один вызов за ход там, где Fable 5 группировала несколько. Модель меньше комментирует ход работы, чаще отвечает «из памяти» на низком уровне усилий и предпочитает полную перезапись файлов точечным правкам.
То, что Anthropic сама публикует список регрессий, а не прячет их в changelog, выделяет этот релиз на фоне обновлений конкурентов, где о деградациях пользователи обычно узнают на практике.
Три изменения API, которые сломают код
Это не мелкие правки. Каждое из трёх изменений способно остановить работающего агента.
-
Принудительный вызов инструментов убран. Если
tool_choiceустановлен вanyилиtool(принудительное использование инструмента), API вернёт ошибку 400. Нужно переключиться наautoс режимом строгого использования инструментов или структурированных выходов. -
Блоки мышления привязаны к модели. Claude Fable 5.1 читает блоки мышления от более ранних моделей, но ни одна ранняя модель не читает блоки Fable 5.1. Если ваш маршрутизатор переключается на младшую модель при сбое, рассуждения (reasoning, цепочка мыслей модели) теряются.
-
Редактирование ранних реплик ломает блоки мышления. Вставка, удаление напоминаний между ходами или перестройка массива
system/toolsпосреди разговора теперь вызывает ошибку. Проверка включена для аккаунтов, созданных 31 августа 2026 года и позже. Исправление: используйте системные сообщения на уровне хода и серверное редактирование контекста.
Как попробовать Claude 5.1?
- Откройте Claude API напрямую (модель
claude-fable-5-1) или через Amazon Bedrock, Claude Platform на AWS, Google Cloud, Microsoft Foundry. - Перед подключением проверьте три несовместимости выше: убедитесь, что
tool_choiceне выставлен вanyилиtool, что маршрутизатор не полагается на блоки мышления от Fable 5.1 при откате на старую модель, и что вы не редактируете ранние реплики в диалоге. - Для агентных и RAG-сценариев пересчитайте бюджет: кэш-чтение теперь $0.25 за миллион токенов, экономия на длинных контекстах достигает 45% по данным Anthropic.
Есть ли аналоги в России?
Прямого аналога Claude Fable 5.1 в РФ нет: ни YandexGPT, ни GigaChat не предлагают контекстное окно в миллион токенов и не публикуют результаты на Terminal-Bench. Для задач на русском языке YandexGPT и GigaChat остаются рабочими вариантами, но ценовая модель у них принципиально другая, и сравнение «в лоб» по стоимости токена некорректно.
Claude API доступен из РФ с ограничениями: потребуется оплата зарубежной картой и, в некоторых случаях, VPN. Amazon Bedrock и Google Cloud работают, но тарификация может отличаться от прямого API.
По моим наблюдениям, снижение кэш-чтения на 75% меняет экономику в первую очередь для тех, кто строит агентов с длинными историями диалогов или подгружает большие базы знаний в контекст. Если вы платили $100 в месяц за кэш, теперь платите $25, и это уже аргумент пересмотреть, какие задачи отдать Claude, а какие решать локально.
Но я бы не торопился обновлять рабочие пайплайны без тестирования. Три breaking changes реальны, и особенно опасен второй: если ваш маршрутизатор при сбое переключает модель на предыдущую версию, блоки мышления исчезают молча, без ошибки.
Что сделать автору Дзена сегодня: если вы используете Claude через API для генерации или редактуры, проверьте, не выставлен ли tool_choice в any. Если используете веб-интерфейс, ничего не сломается: изменения касаются только API.
Что учесть предпринимателю в РФ: доступ к Claude API требует зарубежной оплаты. Пересчитайте стоимость ваших агентных решений с новыми ценами на кэш и сравните с текущими затратами, возможно, часть задач выгоднее перенести на Claude Fable 5.1.
Частые вопросы
Claude Fable 5.1 и Claude Mythos 5.1 одна и та же модель?
Да. По данным Anthropic, это одна базовая модель с разными уровнями защитных фильтров. На бенчмарке Terminal-Bench 4.0 Fable 5.1 набирает 55.8%, а Mythos 5.1, 60.9%. Разница в 5.1 пункта, это именно стоимость срабатывания защитных ограничений. Anthropic сама называет это «необычно честным раскрытием».
Нужно ли срочно переписывать код под Claude 5.1?
Если вы используете tool_choice со значением any или tool, редактируете ранние реплики в диалоге или полагаетесь на откат к старым моделям с сохранением мышления, да. Для аккаунтов, созданных до 31 августа 2026 года, проверка редактирования реплик пока не включена, но две другие несовместимости действуют для всех.
Данные хранятся? Можно ли запретить?
По данным Anthropic, действует 30-дневное хранение. Нулевое хранение (zero data retention, когда данные не сохраняются вообще) требует отдельного разрешения. На весь выход модели ставится статистический текстовый водяной знак, а файлы получают метаданные C2PA (стандарт подтверждения происхождения контента). Отключить водяной знак нельзя.
Три несовместимости в API, это реальная угроза для работающих агентов, и разбираться с ними лучше до того, как продакшн-код начнёт возвращать ошибку 400.

Основатель dzen.guru. Эксперт по монетизации и продвижению на Дзен. Автор курса «Старт на Дзен 2026».
Читайте также

Google встроила голосовой ввод с Gemini в Gmail, Docs и Keep: ИИ сам ищет и оформляет
Google встроила голосовое управление через Gemini в Gmail, Docs и Keep, и на этой неделе функция стала доступна подписчикам, а для бизнес-аккаунтов Google…

Предиктивное обслуживание на НПЗ: как 21 датчик предсказывает поломку за 60 дней
Сергей Михайлов из компании Data Sapience рассказал, как его команда построила систему предиктивного обслуживания для центробежного насоса на реальном…

Nvidia покупает Hugging Face за $12,93 млрд: что ждёт пользователей открытых моделей
Nvidia согласилась купить Hugging Face, крупнейшую открытую платформу для ИИ-моделей и данных, за 12,93 млрд долларов, и это напрямую касается всех, кто в…
Комментарии