Игорь Градов
Игорь Градов
4 мин
ai

Наследник Claude 3 Opus стал на 20% дешевле и обошёл Fable в бенчмарках

Anthropic второго октября представила Claude Opus 5.5, самую мощную модель в линейке Claude, которая обходит конкурирующую Fable по ряду тестов и при этом стоит на 20% дешевле предшественника.

Наследник Claude 3 Opus стал на 20% дешевле и обошёл Fable в бенчмарках
Почему это важно

Снижение цены на выходные токены с 25 до 20 долларов за миллион при росте скорости и качества ответов напрямую влияет на экономику любого продукта, построенного на API Claude, от чат-ботов до агентных систем.

Anthropic выпустила обновление спустя всего два месяца после выхода Opus 5 (24 июля). Компания позиционирует Claude Opus 5.5 как новый лучший результат в задачах программирования и интеллектуальной работы с текстом. Релиз вышел на фоне публичного заявления генерального директора Дарио Амодеи о сознательном замедлении гонки возможностей ИИ ради того, чтобы системы безопасности успевали за прогрессом.

Показатель Значение Источник
Цена выходных токенов 20 долларов за 1 млн токенов (было 25) Anthropic
Снижение цены 20% Anthropic
Срок после предыдущего релиза 2 месяца (Opus 5 вышла 24 июля) Anthropic
Сравнение с Fable Превосходит по ряду бенчмарков Anthropic
Сравнение с Mythos Сопоставима по биологии и кибербезопасности Anthropic
Следующие модели Sonnet 5.5 и Haiku 5.5 «в ближайшие недели» Anthropic

Что именно проверяли?

Anthropic использует трёхуровневую линейку Claude. Opus занимает верхний уровень: самая мощная, но и самая дорогая модель. Sonnet стоит посередине, Haiku работает быстрее всех и стоит дешевле всех.

Claude Opus 5.5 тестировали на стандартных бенчмарках (тестах производительности, где модели решают одинаковые задачи для сравнения) в области кода и работы со знаниями. Помимо формальных замеров, Anthropic отмечает успехи модели в «неформальных задачах», с которыми конкурирующая модель Fable не справилась. Какие именно задачи имеются в виду, компания не уточнила.

Отдельно оценивали безопасность. По возможностям в биологии и кибербезопасности Opus 5.5 сопоставима с моделью Mythos, поэтому на неё распространяются те же ограничения, что и на Fable: лимиты на поиск уязвимостей в скомпилированных программах и на помощь в создании биологического оружия.

Что обнаружили?

  • Производительность выше при меньшей цене. Opus 5.5 превосходит Fable по ряду бенчмарков, при этом стоимость выходных токенов (токен, это минимальная единица текста, которую модель обрабатывает и за которую вы платите) снизилась с 25 до 20 долларов за миллион.
  • Модель стала быстрее. Anthropic сообщает об общем снижении вычислительных затрат на обслуживание модели. Конкретных цифр ускорения компания не привела.
  • Ответы стали понятнее. Opus 5.5 реже использует жаргон и чаще ставит самую важную информацию в начало сообщения. Для тех, кто генерирует тексты через API, это означает меньше ручной правки.
  • Безопасность на уровне предшественников. Обучение безопасности (alignment, настройка модели так, чтобы она следовала намерениям пользователя и не причиняла вреда) проходило по схеме, аналогичной предыдущим версиям, с привлечением внешних организаций METR и Frontier Design.
Как это читать

Все заявления о превосходстве над Fable исходят от самой Anthropic. Компания не опубликовала полный список бенчмарков и не раскрыла методологию «неформальных задач». Сравнение с Mythos касается только двух узких областей (биология, кибербезопасность), а не общей производительности. Независимых сторонних замеров на момент анонса нет.

Что это значит для вас?

Авторам Дзена и копирайтерам. Если вы используете Claude Opus через API или через интерфейс Claude Pro для генерации черновиков, Opus 5.5 обещает два конкретных улучшения: текст будет меньше пестрить англоязычным жаргоном, а ключевая мысль будет ближе к началу ответа. На практике это сокращает время редактуры. Стоит проверить на своих задачах, насколько заметна разница.

Маркетологам и тем, кто строит продукты на API. Снижение цены с 25 до 20 долларов за миллион выходных токенов при одновременном росте скорости, это прямая экономия на каждом запросе. Для сервиса, который делает тысячи вызовов в день, разница за месяц ощутима.

Предпринимателям в РФ и СНГ. Claude Opus напрямую из России недоступен без VPN и иностранной карты. Из доступных в РФ аналогов по классу задач подходят YandexGPT и GigaChat. Однако если ваш стартап работает на зарубежных рынках или использует API через прокси, снижение стоимости Claude Opus 5.5 стоит заложить в пересчёт unit-экономики (стоимости обслуживания одного пользователя).

Мнение редакции dzen.guru

Два месяца между Opus 5 и Opus 5.5 при одновременном снижении цены и заявлениях Амодеи о «сознательном замедлении», это любопытное противоречие. На мой взгляд, «замедление» касается не частоты релизов, а степени наращивания опасных возможностей: компания выпускает модели чаще, но ставит на них те же ограничения, что и на прошлое поколение.

Для практиков главное другое: ценовая война между Anthropic, OpenAI и Google делает мощные модели доступнее с каждым кварталом. Если вы откладывали миграцию с дешёвых моделей среднего уровня на топовые, сейчас разрыв в цене сужается быстрее, чем разрыв в качестве.

Обещанные Sonnet 5.5 и Haiku 5.5 должны выйти «в ближайшие недели», и если ценовая логика сохранится, средний и бюджетный уровни тоже подешевеют. Тем, кто платит за API, имеет смысл не фиксировать бюджеты до выхода всей обновлённой линейки.

«Я убедился, что для полного устранения рисков нужна ещё большая осторожность: не только инвестиции в предотвращение рисков, но и контроль темпа развития возможностей, чтобы работа над безопасностью успевала за прогрессом» : Дарио Амодеи, генеральный директор Anthropic

По данным Anthropic.

Поделиться:TelegramVK
Игорь Градов
Игорь Градов

Основатель dzen.guru. Эксперт по монетизации и продвижению на Дзен. Автор курса «Старт на Дзен 2026».

Комментарии

Читайте также

AI видимость бренда зависит от истории чата: эксперимент на 45 диалогах
ai

AI видимость бренда зависит от истории чата: эксперимент на 45 диалогах

Маркер Markdown-тела начинается ниже. Если вы измеряете, как часто нейросеть упоминает ваш бренд, но задаёте ей только одиночные запросы без контекста,…

5 мин
277 часов с нейросетью для тестирования: 94 бага найдены, но человек потратил ещё 213 часов рядом
ai

277 часов с нейросетью для тестирования: 94 бага найдены, но человек потратил ещё 213 часов рядом

Компания Anthropic не выпускала новый продукт и не объявляла релиз. Речь о другом: практик-тестировщик 11 недель вёл дневник совместной работы с Claude Code и…

5 мин
Провалы виртуальной стены на границе
ai

Провалы виртуальной стены на границе

Американское правительство потратило миллиарды долларов на «виртуальную стену» из камер наблюдения с искусственным интеллектом вдоль южной границы, но…

5 мин