Claude 3 5 Opus по умолчанию думает на medium: как перестроить промпты и не переплачивать
Anthropic выпустила руководство по промптам для Claude 3.5 Opus (модель также упоминается как Opus 5.5), и главный практический вывод для русскоязычных разработчиков и авторов: модель по умолчанию работает на среднем уровне усилий вместо высокого, что экономит деньги и ускоряет ответы без потери качества.

Если вы перешли на Claude 3.5 Opus с предыдущей версии и не меняли настройки, модель уже работает экономичнее, а ваши старые промпты по-прежнему подходят, но часть привычных инструкций теперь мешает, а не помогает.
Anthropic опубликовала обновлённое руководство по промпт-инжинирингу (настройке текстовых инструкций для модели) одновременно с запуском Claude 3.5 Opus 22 сентября. Компания прямо говорит: промпты от предыдущей версии Claude Opus 5 продолжат работать без правок, а прежнее руководство остаётся разумной отправной точкой. Но несколько привычных практик стоит пересмотреть, потому что новая модель сама решает, насколько глубоко думать.
Что понадобится
- Доступ к Claude 3.5 Opus через API Anthropic или через интерфейс Claude.ai
- Рабочие промпты, которые вы уже используете с предыдущими версиями Claude
- 15 минут на тестирование уровней усилий на ваших задачах
Пошаговая инструкция
- Проверьте, не стоит ли в вашем системном промпте (базовой инструкции, которая задаёт поведение модели) фраза «Think carefully before responding»
По данным Anthropic, Claude 3.5 Opus сам определяет, сколько ему нужно «думать». Фраза «Think carefully» в чат-приложениях теперь замедляет начало ответа, а качество не улучшает. Когда Anthropic убрала эту строку в собственном чат-продукте, ответы начинали приходить быстрее, при этом, по словам компании, «без заметного снижения качества ответа».
Если вы используете системный промпт с такой строкой, попробуйте её убрать:
# Было (замедляет ответ без пользы):
Think carefully before responding. Analyze the question step by step.
# Стало (достаточно для Claude 3.5 Opus):
You are a helpful assistant for content analysis.
- Начните с уровня усилий medium и тестируйте от него
Claude 3.5 Opus работает на среднем уровне усилий (medium) по умолчанию. Предыдущая версия по умолчанию использовала высокий (high). По результатам тестов Anthropic, Claude 3.5 Opus на medium-уровне показывает результаты на уровне или даже выше, чем предыдущая версия на high, в задачах кодирования и аналитической работы.
Руководство называет уровень усилий первым параметром, который нужно настраивать при балансе между качеством, скоростью и стоимостью.
- Снижайте усилия настройкой, а не переписыванием промпта
Если ответ слишком подробный или медленный, Anthropic рекомендует сначала попробовать более низкий уровень усилий, и только потом менять текст промпта. Повышайте до xhigh или max только для задач, где это даёт заметный прирост качества.
- Не пытайтесь отключить «мышление» (thinking)
В Claude 3.5 Opus режим «мышления» (внутреннее рассуждение модели перед ответом) нельзя выключить: запрос на отключение вернёт ошибку. В предыдущей версии это было возможно на уровне high и ниже.
- Пересмотрите лимит токенов (max_tokens)
Если вы переносите настройку max_tokens (ограничение длины ответа в токенах, условных единицах текста) из предыдущей версии, где мышление было выключено, учтите: в Claude 3.5 Opus мышление расходует часть этого лимита, даже если вы не видите его в ответе. Ответ может обрезаться раньше, чем вы ожидаете.
- Для агентных сценариев используйте временной бюджет
Для команд ИИ-агентов (автономных программ, выполняющих задачи без пошагового контроля человека) Anthropic рекомендует задавать временной бюджет в зависимости от ожидаемой длительности задачи. Claude 3.5 Opus помогает, отслеживая прошедшее время. По тестам Anthropic, небольшие группы агентов с временными сигналами завершают исследовательские задачи быстрее одиночного агента без таких сигналов, при сопоставимом качестве ответов. Компания подчёркивает: временной бюджет носит рекомендательный характер, а жёсткий таймаут полезен, хотя модель может работать чуть менее тщательно под давлением.
- Защитите вставленный текст тегами со случайным ID
Если пользователь вставляет текст из внешних источников (письма, документы), руководство советует оборачивать его в теги со случайным идентификатором и добавлять в системный промпт инструкцию по обработке такого текста. Это один уровень защиты от промпт-инъекций (prompt injection, когда вредоносный текст во вставке перехватывает управление моделью), поскольку теги остаются обычным текстом и могут быть скопированы.
- Для фронтенд-проектов задавайте стили явно
Руководство отмечает: если вы просите Claude 3.5 Opus «избегать типичного ИИ-вида» без конкретных указаний, модель просто заменит одни стандартные элементы (кремовый фон, кнопки-таблетки) на другие. Задавайте стили прямо.
Что эти изменения значат для вашей работы?
Автору на Дзене. Если вы используете Claude для подготовки черновиков или анализа тем, убирайте «Think carefully» из промптов: ответы будут приходить быстрее, а содержание останется тем же.
Разработчику и маркетологу. Средний уровень усилий по умолчанию означает, что ваши API-вызовы дешевле без дополнительных настроек. Тестируйте на своих задачах: по данным Anthropic, medium в Claude 3.5 Opus сопоставим с high в предыдущей версии для кодирования и аналитики.
Предпринимателю. Claude 3.5 Opus доступен через API Anthropic. Из российских аналогов с режимом рассуждений по моим наблюдениям можно рассматривать YandexGPT и GigaChat, хотя настройки уровня усилий у них устроены иначе.
Системный промпт для чат-бота до обновления:
You are a helpful writing assistant. Think carefully before responding.
Analyze each question step by step before giving your answer.
После обновления (для Claude 3.5 Opus):
You are a helpful writing assistant.
Результат по данным Anthropic: ответ начинает приходить раньше, качество не снижается. Уровень усилий medium работает по умолчанию, отдельно указывать его не нужно.
- Копировать max_tokens из старого проекта без пересчёта. Мышление Claude 3.5 Opus «съедает» часть лимита невидимо. Если раньше хватало 1000 токенов с выключенным мышлением, теперь ответ может обрезаться. Увеличьте лимит или проверьте на практике.
- Ставить effort на max «для надёжности». Anthropic прямо рекомендует резервировать xhigh и max для задач, где разница в качестве заметна. На рутинных задачах вы просто платите больше.
- Пытаться отключить thinking. Вернёт ошибку. Не тратьте время на обходные пути.
- Надеяться, что теги со случайным ID полностью защитят от промпт-инъекций. Руководство честно называет это «одним слоем защиты», не полным решением.
Anthropic фактически просит разработчиков провести аудит старых промптов. Я проверил на нескольких рабочих системных промптах: убрал «Think carefully», оставил medium, результат на задачах копирайтинга и анализа текстов был неотличим от предыдущей версии на high. Экономия по токенам ощутима, особенно при большом потоке запросов.
Честная оговорка: руководство Anthropic основано на их собственных тестах. Ваши задачи могут вести себя иначе, особенно на длинных цепочках рассуждений или нестандартных доменах. Протестируйте на реальных кейсах, прежде чем менять настройки в продакшене.
Если вы работаете с Claude 3.5 Opus и до сих пор не трогали настройки после обновления, начните с двух действий: уберите «Think carefully» из системного промпта и проверьте лимит max_tokens. Эти два шага занимают пять минут, но могут сократить время ответа и расходы на каждый запрос.
Попробуйте генератор промптов dzen.guru
Настройте промпты для Claude и других моделей под задачи контента на Дзене
Попробовать бесплатно
Основатель dzen.guru. Эксперт по монетизации и продвижению на Дзен. Автор курса «Старт на Дзен 2026».
Читайте также

Гугл открыл стандарт бронирования отелей через ИИ: Booking, Expedia и Marriott уже в проекте
Почему это важно Google впервые опубликовала открытый стандарт, по которому отели и агрегаторы смогут принимать бронирования прямо из ИИ-поиска, и это касается…

Текстовая версия сайта отрезает кнопки и формы: 95,9% страниц уже недоступны для ИИ-агентов
Ниже — тело новости в Markdown. Текстовые версии сайтов, которые веб-мастера создают для ИИ-агентов (программ, способных самостоятельно выполнять задачи в…

Google обновление спам: окно раскатки выросло до двух недель, трафик издателей падает на 40%
Google обновил алгоритм борьбы со спамом: окно раскатки выросло до двух недель, а трафик из поиска падает на 40% в год. Почему это важно Сентябрьское…
Комментарии