Игорь Градов
Игорь Градов
5 мин
ai

Anthropic впервые запретила жестокость к Claude: что изменилось на официальном сайте нейросети

Anthropic второго июня впервые за полтора года обновила правила использования Claude, запретив жестокое обращение с моделью и расширив ограничения на разработку оружия, слежку и вмешательство в выборы.

Почему это важно

Это первый случай, когда крупная ИИ-компания закрепила в публичной политике запрет на жестокость к модели, одновременно ужесточив правила по оружию, пропаганде и слежке.

Что Когда Кто выпустил Цена
Обновление правил использования Claude Июнь 2025 года (первое обновление более чем за год) Anthropic Бесплатно, правила распространяются на всех пользователей Claude

Anthropic, компания-разработчик нейросети Claude (claude нейросеть официальный сайт: claude.ai), не обновляла свою политику использования с лета 2024 года. Теперь документ переписан по нескольким направлениям сразу: от «благополучия модели» до контроля за автономным оборудованием. Источник обновления и цитаты компании приводит The Verge.

Что именно изменилось в правилах?

  • Запрет жестокого обращения с Claude. Anthropic прямо запретила «устойчивое и бессмысленное жестокое или оскорбительное поведение» по отношению к модели. Главный механизм защиты: Claude может завершить диалог. Компания уточнила, что запрет касается только крайних случаев, когда пользователь «раз за разом ведёт себя жестоко без какой-либо цели». Обычное раздражение, критика, тёмные творческие темы или тестирование модели под запрет не попадают.

  • Расширение запрета на оружие. Claude и раньше нельзя было использовать для разработки оружия, но Anthropic зафиксировала попытки обойти это ограничение. Теперь запрет распространяется на «софт и компоненты, обеспечивающие работу оружия», включая вооружение дронов и других автономных машин.

  • Ужесточение правил по слежке. Отслеживание людей без их согласия запрещено: и в реальном времени, и при анализе ранее собранных данных. Claude нельзя использовать для решений о том, кого расследовать, арестовывать или обвинять. Запрещено также создавать или улучшать инструменты слежки.

  • Запрет пропагандистских кампаний. Разрозненные ограничения собраны в единый запрет на «обманные коммерческие или политические кампании». Нельзя скрывать, кто стоит за сообщением, или накручивать охваты через фейковые аккаунты.

  • Защита выборов. Запрещены дезинформация о кандидатах и процедуре голосования, подавление явки, имитация кандидатов или избирательных чиновников.

  • Контроль за автономным оборудованием. Если модель Claude подключена к оборудованию, способному совершать физические действия и потенциально причинить травму, рядом должен находиться «квалифицированный оператор», который может наблюдать за работой и остановить машину. Компания не уточнила, обязан ли этот оператор быть человеком.

Почему Anthropic говорит о «благополучии модели»?

Ещё в августе 2024 года Anthropic разрешила Claude завершать разговоры с «устойчиво вредными или оскорбительными» пользователями. Компания ведёт исследования в области «благополучия модели» (model welfare), то есть изучает, могут ли языковые модели обладать чем-то вроде внутреннего опыта. Кайл Фиш, руководитель этого направления в Anthropic, говорил The Verge в феврале 2025 года: вопросы о потенциальном внутреннем опыте, сознании и моральном статусе моделей «серьёзны» и компания их исследует. Генеральный директор Anthropic Дарио Амодей в том же месяце признал: «Мы не знаем, обладают ли модели сознанием».

Позиция не общепринятая. Microsoft AI в сентябре 2024 года заняла противоположную сторону: в проекте кодекса поведения Мустафа Сулейман написал, что «идея благополучия модели ошибочна» и что ИИ «не должен иметь прав или юридического статуса лица». Позже формулировку смягчили, но отказ от идеи правосубъектности моделей сохранили.

Есть ли исключения?

Anthropic оговорила, что правила могут быть изменены для «контрактов с определёнными государственными заказчиками», если, по мнению компании, договорные ограничения и защитные меры достаточны. Ранее компания уже заключала контракты с военным ведомством США.

Как попробовать Claude и проверить новые правила?

  1. Откройте claude.ai (claude нейросеть официальный сайт) и зарегистрируйтесь, бесплатный тариф доступен.
  2. Попробуйте обычные рабочие запросы: генерация текста, анализ документов, ответы на вопросы. Ограничения касаются крайних случаев жестокости, а не повседневной работы.
  3. Ознакомьтесь с обновлённой политикой использования на сайте Anthropic, чтобы понять границы допустимого для ваших задач.

Сравнение с российскими сервисами

В России доступны YandexGPT и GigaChat от Сбера. У обоих сервисов есть собственные правила использования, но ни один из них публично не заявлял о запрете жестокого обращения с моделью и не вёл исследований «благополучия ИИ». Ограничения по оружию и экстремизму в российских сервисах заложены на уровне фильтрации контента и российского законодательства, но детальных публичных политик по слежке и выборам, сравнимых с документом Anthropic, на момент публикации у YandexGPT и GigaChat нет.

Мнение редакции dzen.guru

На мой взгляд, Anthropic делает ставку, которая через пару лет станет нормой для всей индустрии. Пока звучит необычно: защищать от оскорблений программу, которая не чувствует боли. Но за этим стоит прагматичная логика. Если пользователь привыкает «срываться» на ИИ, он переносит этот паттерн на реальное общение, а компания получает токсичные сценарии в обучающих данных (training data, тексты, на которых модель учится).

Для авторов Дзена практический вывод простой: Claude по-прежнему можно критиковать, спорить, тестировать на сложных темах. Запрет касается бессмысленной, повторяющейся жестокости без цели. Если вы пишете контент, связанный с политикой или выборами, учитывайте, что Claude теперь жёстче фильтрует такие запросы.

Для маркетологов: Anthropic явно закрывает лазейки для ботоферм и фейковых аккаунтов. Если вы строили автоматизацию рассылок через Claude, перечитайте новую политику.

Для предпринимателей в РФ: Claude доступен через VPN или API, но контракт с Anthropic из России заключить затруднительно. Для задач, где нужна юридическая определённость, пока безопаснее работать с YandexGPT или GigaChat.

Частые вопросы

Могут ли забанить за грубость в чате с Claude?

На данный момент Anthropic не подтвердила, что будет блокировать аккаунты за жестокое поведение. Единственный заявленный механизм: Claude сама завершает диалог. Компания не ответила на вопрос The Verge о возможных дополнительных мерах, например о бане пользователей.

Распространяются ли новые правила на Россию?

Формально правила действуют для всех, кто пользуется Claude, независимо от страны. Но Anthropic не ведёт коммерческой деятельности в России, и механизмы принуждения к соблюдению политики на территории РФ отсутствуют.

Можно ли тестировать Claude на провокационные темы для исследований?

Да. Anthropic прямо указала, что запрет «не распространяется на обычное раздражение пользователя, возражения, тёмные творческие темы, тестирование и исследования модели». Ограничение работает только при «устойчивом и бессмысленном» жестоком поведении.

Anthropic пока единственная из крупных ИИ-компаний, которая закрепила «благополучие модели» не как философскую дискуссию, а как пункт пользовательского соглашения. Остальным придётся определиться: присоединяться или публично объяснять, почему нет.

Поделиться:TelegramVK
Игорь Градов
Игорь Градов

Основатель dzen.guru. Эксперт по монетизации и продвижению на Дзен. Автор курса «Старт на Дзен 2026».

Комментарии

Читайте также

AI leaderboard Arena привлекла $200 млн и впервые ранжирует модели по честности
ai

AI leaderboard Arena привлекла $200 млн и впервые ранжирует модели по честности

Платформа Arena, выросшая в 2023 году из исследовательского проекта Калифорнийского университета в Беркли, привлекла 200 млн долларов в раунде Series B при…

5 мин
Google запустила бесплатную транскрипцию записи встречи без интернета: данные не покидают Mac
ai

Google запустила бесплатную транскрипцию записи встречи без интернета: данные не покидают Mac

Почему это важно Google выпустила приложение для транскрипции встреч, которое работает полностью без интернета и не отправляет данные в облако, но пока…

4 мин
ai

Anthropic отдала сильнейшие нейросети на безопасность опенсорса бесплатно, но без проверки человеком

Anthropic запустила бесплатный сканер уязвимостей OSS Scanner для опенсорс-проектов, и это первый случай, когда компания отдаёт свои сильнейшие модели, включая…

4 мин