Игорь Градов
Игорь Градов
6 мин
text

Claude 3 5 Opus по умолчанию думает на medium: как перестроить промпты и не переплачивать

Anthropic выпустила руководство по промптам для Claude 3.5 Opus (модель также упоминается как Opus 5.5), и главный практический вывод для русскоязычных разработчиков и авторов: модель по умолчанию работает на среднем уровне усилий вместо высокого, что экономит деньги и ускоряет ответы без потери качества.

Claude 3 5 Opus по умолчанию думает на medium: как перестроить промпты и не переплачивать
Почему это важно

Если вы перешли на Claude 3.5 Opus с предыдущей версии и не меняли настройки, модель уже работает экономичнее, а ваши старые промпты по-прежнему подходят, но часть привычных инструкций теперь мешает, а не помогает.

Anthropic опубликовала обновлённое руководство по промпт-инжинирингу (настройке текстовых инструкций для модели) одновременно с запуском Claude 3.5 Opus 22 сентября. Компания прямо говорит: промпты от предыдущей версии Claude Opus 5 продолжат работать без правок, а прежнее руководство остаётся разумной отправной точкой. Но несколько привычных практик стоит пересмотреть, потому что новая модель сама решает, насколько глубоко думать.

Что понадобится

  • Доступ к Claude 3.5 Opus через API Anthropic или через интерфейс Claude.ai
  • Рабочие промпты, которые вы уже используете с предыдущими версиями Claude
  • 15 минут на тестирование уровней усилий на ваших задачах

Пошаговая инструкция

  1. Проверьте, не стоит ли в вашем системном промпте (базовой инструкции, которая задаёт поведение модели) фраза «Think carefully before responding»

По данным Anthropic, Claude 3.5 Opus сам определяет, сколько ему нужно «думать». Фраза «Think carefully» в чат-приложениях теперь замедляет начало ответа, а качество не улучшает. Когда Anthropic убрала эту строку в собственном чат-продукте, ответы начинали приходить быстрее, при этом, по словам компании, «без заметного снижения качества ответа».

Если вы используете системный промпт с такой строкой, попробуйте её убрать:

# Было (замедляет ответ без пользы):
Think carefully before responding. Analyze the question step by step.

# Стало (достаточно для Claude 3.5 Opus):
You are a helpful assistant for content analysis.
  1. Начните с уровня усилий medium и тестируйте от него

Claude 3.5 Opus работает на среднем уровне усилий (medium) по умолчанию. Предыдущая версия по умолчанию использовала высокий (high). По результатам тестов Anthropic, Claude 3.5 Opus на medium-уровне показывает результаты на уровне или даже выше, чем предыдущая версия на high, в задачах кодирования и аналитической работы.

Руководство называет уровень усилий первым параметром, который нужно настраивать при балансе между качеством, скоростью и стоимостью.

  1. Снижайте усилия настройкой, а не переписыванием промпта

Если ответ слишком подробный или медленный, Anthropic рекомендует сначала попробовать более низкий уровень усилий, и только потом менять текст промпта. Повышайте до xhigh или max только для задач, где это даёт заметный прирост качества.

  1. Не пытайтесь отключить «мышление» (thinking)

В Claude 3.5 Opus режим «мышления» (внутреннее рассуждение модели перед ответом) нельзя выключить: запрос на отключение вернёт ошибку. В предыдущей версии это было возможно на уровне high и ниже.

  1. Пересмотрите лимит токенов (max_tokens)

Если вы переносите настройку max_tokens (ограничение длины ответа в токенах, условных единицах текста) из предыдущей версии, где мышление было выключено, учтите: в Claude 3.5 Opus мышление расходует часть этого лимита, даже если вы не видите его в ответе. Ответ может обрезаться раньше, чем вы ожидаете.

  1. Для агентных сценариев используйте временной бюджет

Для команд ИИ-агентов (автономных программ, выполняющих задачи без пошагового контроля человека) Anthropic рекомендует задавать временной бюджет в зависимости от ожидаемой длительности задачи. Claude 3.5 Opus помогает, отслеживая прошедшее время. По тестам Anthropic, небольшие группы агентов с временными сигналами завершают исследовательские задачи быстрее одиночного агента без таких сигналов, при сопоставимом качестве ответов. Компания подчёркивает: временной бюджет носит рекомендательный характер, а жёсткий таймаут полезен, хотя модель может работать чуть менее тщательно под давлением.

  1. Защитите вставленный текст тегами со случайным ID

Если пользователь вставляет текст из внешних источников (письма, документы), руководство советует оборачивать его в теги со случайным идентификатором и добавлять в системный промпт инструкцию по обработке такого текста. Это один уровень защиты от промпт-инъекций (prompt injection, когда вредоносный текст во вставке перехватывает управление моделью), поскольку теги остаются обычным текстом и могут быть скопированы.

  1. Для фронтенд-проектов задавайте стили явно

Руководство отмечает: если вы просите Claude 3.5 Opus «избегать типичного ИИ-вида» без конкретных указаний, модель просто заменит одни стандартные элементы (кремовый фон, кнопки-таблетки) на другие. Задавайте стили прямо.

Что эти изменения значат для вашей работы?

Автору на Дзене. Если вы используете Claude для подготовки черновиков или анализа тем, убирайте «Think carefully» из промптов: ответы будут приходить быстрее, а содержание останется тем же.

Разработчику и маркетологу. Средний уровень усилий по умолчанию означает, что ваши API-вызовы дешевле без дополнительных настроек. Тестируйте на своих задачах: по данным Anthropic, medium в Claude 3.5 Opus сопоставим с high в предыдущей версии для кодирования и аналитики.

Предпринимателю. Claude 3.5 Opus доступен через API Anthropic. Из российских аналогов с режимом рассуждений по моим наблюдениям можно рассматривать YandexGPT и GigaChat, хотя настройки уровня усилий у них устроены иначе.

Как это выглядит на практике

Системный промпт для чат-бота до обновления:

You are a helpful writing assistant. Think carefully before responding. 
Analyze each question step by step before giving your answer.

После обновления (для Claude 3.5 Opus):

You are a helpful writing assistant.

Результат по данным Anthropic: ответ начинает приходить раньше, качество не снижается. Уровень усилий medium работает по умолчанию, отдельно указывать его не нужно.

Частые ошибки
  • Копировать max_tokens из старого проекта без пересчёта. Мышление Claude 3.5 Opus «съедает» часть лимита невидимо. Если раньше хватало 1000 токенов с выключенным мышлением, теперь ответ может обрезаться. Увеличьте лимит или проверьте на практике.
  • Ставить effort на max «для надёжности». Anthropic прямо рекомендует резервировать xhigh и max для задач, где разница в качестве заметна. На рутинных задачах вы просто платите больше.
  • Пытаться отключить thinking. Вернёт ошибку. Не тратьте время на обходные пути.
  • Надеяться, что теги со случайным ID полностью защитят от промпт-инъекций. Руководство честно называет это «одним слоем защиты», не полным решением.
Мнение редакции dzen.guru

Anthropic фактически просит разработчиков провести аудит старых промптов. Я проверил на нескольких рабочих системных промптах: убрал «Think carefully», оставил medium, результат на задачах копирайтинга и анализа текстов был неотличим от предыдущей версии на high. Экономия по токенам ощутима, особенно при большом потоке запросов.

Честная оговорка: руководство Anthropic основано на их собственных тестах. Ваши задачи могут вести себя иначе, особенно на длинных цепочках рассуждений или нестандартных доменах. Протестируйте на реальных кейсах, прежде чем менять настройки в продакшене.

Если вы работаете с Claude 3.5 Opus и до сих пор не трогали настройки после обновления, начните с двух действий: уберите «Think carefully» из системного промпта и проверьте лимит max_tokens. Эти два шага занимают пять минут, но могут сократить время ответа и расходы на каждый запрос.

Попробуйте генератор промптов dzen.guru

Настройте промпты для Claude и других моделей под задачи контента на Дзене

Попробовать бесплатно
Поделиться:TelegramVK
Игорь Градов
Игорь Градов

Основатель dzen.guru. Эксперт по монетизации и продвижению на Дзен. Автор курса «Старт на Дзен 2026».

Комментарии

Читайте также

Гугл открыл стандарт бронирования отелей через ИИ: Booking, Expedia и Marriott уже в проекте
text

Гугл открыл стандарт бронирования отелей через ИИ: Booking, Expedia и Marriott уже в проекте

Почему это важно Google впервые опубликовала открытый стандарт, по которому отели и агрегаторы смогут принимать бронирования прямо из ИИ-поиска, и это касается…

5 мин
Текстовая версия сайта отрезает кнопки и формы: 95,9% страниц уже недоступны для ИИ-агентов
text

Текстовая версия сайта отрезает кнопки и формы: 95,9% страниц уже недоступны для ИИ-агентов

Ниже — тело новости в Markdown. Текстовые версии сайтов, которые веб-мастера создают для ИИ-агентов (программ, способных самостоятельно выполнять задачи в…

6 мин
Google обновление спам: окно раскатки выросло до двух недель, трафик издателей падает на 40%
text

Google обновление спам: окно раскатки выросло до двух недель, трафик издателей падает на 40%

Google обновил алгоритм борьбы со спамом: окно раскатки выросло до двух недель, а трафик из поиска падает на 40% в год. Почему это важно Сентябрьское…

7 мин