Игорь Градов
Игорь Градов
6 мин
ai

Claude 3 Haiku обновился до 1 млн токенов контекста и подешевел в 10 раз

Anthropic выпустила Claude Haiku 5.5, самую дешёвую модель в линейке, с контекстным окном в 1 млн токенов (столько текста помещается в одну сессию) и ценой от $0,10 за миллион входных токенов, что по данным компании на 75% дешевле предыдущей версии.

Почему это важно

Haiku 5.5 стоит в 10 раз меньше предшественника Haiku 4.5 на коротких запросах и при этом обгоняет конкурента GPT-6 Luna в тестах на работу с интерфейсами и терминалом по данным Anthropic, делая массовые задачи вроде обработки документов и клиентской поддержки доступными даже при плотном потоке запросов.

Anthropic позиционирует модель не как замену старших собратьев Sonnet 5.5 и Opus 5.5, а как быстрого помощника для рутины: суммаризация, классификация, ответы на вопросы по документам, работа в роли подагента (когда маленькая модель выполняет подзадачу внутри более сложной системы). Об этом компания сообщила в официальном анонсе, опубликованном на своём сайте. Модель уже доступна через API Anthropic, Amazon Bedrock, Google Cloud, Microsoft Foundry и Claude Platform на AWS.

Что Когда Кто выпустил Цена
Claude Haiku 5.5 Доступна сейчас (дата знаний модели: июнь 2026) Anthropic От $0,10 за 1 млн входных токенов, $0,50 за 1 млн выходных (при промптах до 100K токенов)

Что изменилось по сравнению с Haiku 4.5?

  • Цена упала кратно. Haiku 4.5 стоила $1 за миллион входных и $5 за миллион выходных токенов. Новая версия при промптах до 100K токенов обходится в $0,10 и $0,50 соответственно. По оценке Anthropic, около 90% запросов пользователей Haiku 4.5 укладывались в этот порог, и для них средняя экономия составляет около 75% даже с учётом нового токенизатора.

  • Новый токенизатор считает иначе. Один и тот же текст теперь «весит» примерно на 30% больше токенов, чем раньше. Это важно учитывать при миграции: реальная экономия чуть меньше, чем кажется по прайсу. Anthropic выпустила руководство по миграции.

  • Адаптивное мышление включено по умолчанию. Это первая модель класса Haiku с настройкой уровня усилий (effort): по умолчанию стоит «medium». Модель сама решает, сколько «думать» над ответом, что экономит токены на простых задачах.

  • Контекст 1 млн токенов, выход до 128K токенов. Для пакетных задач (batch) доступен выход до 300K токенов в бета-режиме.

  • Мультимодальность. Модель принимает текст и изображения, выдаёт текст.

  • Ограничение. Нестандартные значения параметров temperature, top_p или top_k возвращают ошибку 400. Это сужает гибкость генерации по сравнению со старшими моделями.

Как выглядят бенчмарки?

Все цифры ниже приведены самой Anthropic в системной карточке модели, независимые замеры на момент анонса компания не указала.

  • OSWorld 2.1 (работа с интерфейсами, офлайн-подмножество): Haiku 5.5 набрала 72,4%, тогда как GPT-6 Luna показала 48,9%, а Haiku 4.5 всего 15,7%.
  • Terminal-Bench 4.0 (задачи в терминале): 39,2% против 16,4% у Luna и 0% у Haiku 4.5.
  • FrontierCode 1.1 (код): 46,4% против 42,4% у Luna.
  • Humanity's Last Exam: 45,9% без инструментов, 57,4% с инструментами.

При этом Anthropic сама признаёт: для сложных агентных задач и кодирования лучше подходят Sonnet 5.5 (70,6% на Terminal-Bench 4.0) и Opus 5.5.

Двухуровневая цена: где подвох?

Прайс делится на два яруса по объёму промпта.

  • До 100K токенов: $0,10 вход, $0,50 выход, кэш-чтение $0,01, запись в кэш $0,125 за миллион.
  • Свыше 100K токенов: $0,50 вход, $2,50 выход.

Для сравнения, GPT-6 Luna от OpenAI предлагает те же $0,10 и $0,50 на коротких промптах, но повышенный тариф включается только после 272K входных токенов и составляет $0,20 и $0,75. На промпте в 150K токенов Luna дешевле по прайсу. Пакетная обработка у Haiku 5.5 снижает цену ещё на 50%.

Для каких задач Haiku 5.5 подходит лучше всего?

Anthropic выделяет три сценария:

  1. Подагент внутри сложной системы. Компания Rogo использует Haiku 5.5 как подагента: маленькая модель вытаскивает строку выручки из отчёта 10-K, а старшая модель собирает итоговую презентацию.
  2. Массовые вопросы и суммаризация документов. Компания AlphaSense протестировала модель на функции, обрабатывающей около 8 млн запросов в неделю.
  3. Работа, чувствительная к скорости: живая клиентская поддержка, автоматизация действий в браузере.

Как попробовать?

  1. Зарегистрируйтесь на console.anthropic.com и получите API-ключ. Модель называется claude-haiku-5.5 (уточняйте актуальное имя в документации).
  2. Отправьте тестовый запрос через API или через Claude Platform на AWS. Для первых экспериментов хватит промпта до 100K токенов, чтобы попасть в нижний ценовой ярус.
  3. Если вы уже работаете с Amazon Bedrock или Google Cloud, модель доступна и там, переключение не требует смены инфраструктуры.

Сравнение с российскими аналогами

Для тех, кто работает в РФ и СНГ, Haiku 5.5 доступна только через API с зарубежной оплатой, что создаёт барьер. Из локальных аналогов для массовых задач остаются YandexGPT и GigaChat от Сбера. Контекстное окно у них заметно меньше (у YandexGPT Pro до 32K токенов по публичной документации Яндекса), а сравнительных бенчмарков на одних и тех же тестах в открытом доступе нет, поэтому корректное сопоставление качества невозможно. Главное преимущество российских моделей: оплата в рублях, серверы в РФ, отсутствие санкционных рисков.

Что делать с этим прямо сейчас, по ролям?

Автору Дзена. Если вы суммаризируете источники, готовите обзоры или обрабатываете большие тексты через API, Haiku 5.5 с контекстом в миллион токенов позволяет загрузить целую книгу в одну сессию. Цена $0,10 за миллион входных токенов означает, что суммаризация романа обойдётся в копейки.

Маркетологу. Классификация отзывов, сортировка заявок, ответы на типовые вопросы клиентов по базе знаний: именно на таких задачах экономия 75% (по оценке Anthropic) относительно предыдущей версии меняет экономику автоматизации.

Предпринимателю в РФ. Прямой доступ к API требует иностранной карты или обходных платёжных решений. Если у вас уже есть инфраструктура на Amazon Bedrock или Google Cloud, переключение на Haiku 5.5 технически простое. Если нет, пока проще оставаться на YandexGPT или GigaChat, а Haiku 5.5 тестировать на отдельных задачах, где нужен именно длинный контекст.

Мнение редакции dzen.guru

По моим наблюдениям, модели класса Haiku закрывают 80% рутинных задач, на которые авторы раньше тратили старшие и дорогие модели. Цена $0,10 за миллион входных токенов при контексте в миллион токенов делает массовую обработку документов реалистичной даже для индивидуального автора, а не только для корпораций.

Оговорка: все бенчмарки в анонсе приведены самой Anthropic, независимых подтверждений пока нет. Новый токенизатор «раздувает» тексты на 30%, поэтому реальная экономия будет меньше заявленных 90% на прайсе, сама компания честно оценивает её в 75%.

Что сделать сегодня: возьмите один свой типовой промпт, отправьте его в Haiku 5.5 через API и сравните результат с тем, что даёт ваша текущая модель. Если качество устраивает, переключайте рутину и сэкономьте бюджет для сложных задач, где нужны Sonnet или Opus.

Частые вопросы

Claude Haiku 5.5 заменяет Claude 3 Haiku?

Haiku 5.5 является прямым наследником линейки: предыдущая версия Haiku 4.5 пришла на смену Claude 3 Haiku (более ранняя модель, с которой многие начинали знакомство с Anthropic). По цене и скорости Haiku 5.5 перекрывает оба предшественника, но помните про новый токенизатор: тот же текст будет стоить на 30% больше токенов, чем в Claude 3 Haiku или Haiku 4.5.

Можно ли использовать из России?

Технически API Anthropic доступен, но оплата требует иностранного платёжного средства. Если вы работаете через Amazon Bedrock или Google Cloud с действующим аккаунтом, модель подключается без дополнительных шагов. Для задач, где зарубежный API неприемлем, остаются YandexGPT и GigaChat.

Для чего Haiku 5.5 не подходит?

Сама Anthropic рекомендует Sonnet 5.5 и Opus 5.5 для сложного агентного кодирования. Haiku 5.5 создана для объёмной, но типовой работы: суммаризация, классификация, подзадачи внутри агентных систем. Если ваша задача требует глубоких рассуждений или генерации сложного кода, выбирайте старшую модель.

Anthropic сделала ставку не на «самую умную», а на «самую дешёвую при достаточном качестве» модель, и для массовых задач это может оказаться важнее рекордных бенчмарков.

Поделиться:TelegramVK
Игорь Градов
Игорь Градов

Основатель dzen.guru. Эксперт по монетизации и продвижению на Дзен. Автор курса «Старт на Дзен 2026».

Комментарии

Читайте также

ai

Anthropic отдала сильнейшие нейросети на безопасность опенсорса бесплатно, но без проверки человеком

Anthropic запустила бесплатный сканер уязвимостей OSS Scanner для опенсорс-проектов, и это первый случай, когда компания отдаёт свои сильнейшие модели, включая…

4 мин
Google встроила нейросеть для создания игр прямо в браузер: код больше не нужен
ai

Google встроила нейросеть для создания игр прямо в браузер: код больше не нужен

Почему это важно Google открыла платформу, где игру можно собрать текстовым промптом без единой строчки кода, и это первый случай, когда нейросеть для создания…

5 мин
ai

Anthropic впервые запретила жестокость к Claude: что изменилось на официальном сайте нейросети

Anthropic второго июня впервые за полтора года обновила правила использования Claude, запретив жестокое обращение с моделью и расширив ограничения на…

5 мин