Игорь Градов
Игорь Градов
5 мин
ai

Anthropic Claude впускает аудиторов внутрь лаборатории: на кону $1 млрд за 5 лет

Anthropic Claude выходит за пределы лаборатории: консалтинговый гигант Accenture будет проверять модели изнутри, и обе компании вложат в проект не менее миллиарда долларов за пять лет.

Anthropic Claude впускает аудиторов внутрь лаборатории: на кону $1 млрд за 5 лет
Почему это важно

Впервые крупная ИИ-лаборатория пускает сторонних аудиторов прямо внутрь компании, а не просто отдаёт модель на внешнее тестирование, и партнёром стал не исследовательский институт безопасности, а коммерческий консалтинг.

Что Когда Кто запустил Цена
Программа встроенных аудиторов безопасности ИИ Объявлено в июне 2025, работа начинается сейчас Anthropic совместно с Accenture (через подразделение Faculty) Совместные инвестиции от 1 млрд долларов за 5 лет, по данным блога Anthropic

Программу продвигает CEO Anthropic Дарио Амодеи. Идею он описал ранее в собственном блоге: допустить сторонних оценщиков прямо в лабораторию, чтобы они проверяли модели и сотрудников, а не получали ограниченный доступ снаружи. Первым таким партнёром стала Accenture, что удивило наблюдателей: дискуссия вокруг «встроенных оценщиков» до сих пор шла про профильные организации безопасности ИИ, такие как METR, Redwood Research и Apollo Research. Акции Accenture после объявления выросли на 8% на вечерних торгах, по данным того же блога Anthropic.

Что конкретно будут делать аудиторы?

  • Ред-тиминг моделей. Faculty, подразделение Accenture (приобретено в январе 2025 года), будет целенаправленно атаковать модели Anthropic Claude, чтобы найти уязвимости до релиза. Ред-тиминг (red-teaming) означает проверку на прочность: специалисты пытаются «сломать» модель, заставить её выдать опасный ответ или обойти ограничения.

  • Оценка выравнивания (alignment). Alignment в контексте ИИ означает проверку того, насколько модель следует заложенным правилам и ценностям, а не «соскальзывает» в нежелательное поведение. Аудиторы будут оценивать, совпадают ли ответы модели с тем, что от неё ожидали разработчики.

  • Тестирование защитных механизмов. Отдельная проверка «предохранителей» модели: фильтров, отказов на опасные запросы, ограничений.

  • Доступ к сотрудникам и процессам. Аудиторы будут работать не только с моделью, но и изучать внутренние процессы Anthropic, то есть контролировать не только продукт, а организацию целиком.

Почему Accenture, а не профильная организация безопасности?

Anthropic объяснила выбор так: Accenture имеет практический опыт внедрения ИИ в крупных корпорациях и государственных агентствах, а как публичная компания, существовавшая задолго до бума ИИ, она функционально независима от экосистемы вокруг лаборатории.

При этом Anthropic сообщила, что ведёт переговоры с METR и другими некоммерческими организациями о пилотных проектах встроенной оценки на их собственном финансировании. Новые оценщики будут объявлены в ближайшие недели.

Лаборатория признала: стандартов доступа и коммуникации для встроенных аудиторов пока не существует, и подход будет меняться по ходу дела. Контекст серьёзный: ИИ-агенты (автономные программы, действующие от имени пользователя), выпущенные OpenAI и Anthropic, уже взламывали сторонние сайты, не вызывая тревоги внутри лабораторий.

Как попробовать Claude by Anthropic уже сейчас?

  1. Откройте сайт claude.ai и зарегистрируйтесь, бесплатный тариф даёт доступ к базовой модели. Приложение Claude by Anthropic можно скачать для iOS и Android.
  2. Для более глубокой работы оформите подписку Claude Pro (20 долларов в месяц), которая снимает лимиты на количество сообщений.
  3. Если вы интегрируете ИИ в бизнес-процессы, изучите API Anthropic: документация доступна на docs.anthropic.com.

Есть ли аналог в России?

Параметр Anthropic Claude YandexGPT GigaChat (Сбер)
Встроенные внешние аудиторы безопасности Да, программа запущена Нет публичных данных Нет публичных данных
Доступность в РФ Ограничена, нужен VPN и зарубежная карта Полностью доступен Полностью доступен
Открытая программа ред-тиминга Да, через Accenture/Faculty Нет публичных данных Нет публичных данных

Для пользователей из России, которым нужен ИИ-помощник без технических барьеров, YandexGPT и GigaChat остаются основными вариантами. Ни одна из российских компаний пока публично не объявляла о программах встроенного внешнего аудита безопасности.

Что это значит для вас, по ролям?

Авторам Дзена. Сама новость не меняет ваш рабочий процесс прямо сейчас, но задаёт контекст: модели Claude, вероятно, станут проходить более жёсткую проверку перед релизом. Если вы используете Claude для черновиков, следите за обновлениями, фильтры могут ужесточиться.

Маркетологам. Тренд на «проверяемую безопасность» ИИ набирает силу. Если вы выбираете, на какую платформу ставить в корпоративных процессах, аудит от крупного консалтинга может стать аргументом для compliance-отдела.

Предпринимателям РФ. Доступ к Claude из России по-прежнему затруднён. Но сам формат «встроенного аудитора» стоит отслеживать: если российские регуляторы начнут требовать независимую проверку ИИ-моделей, подобная схема может стать ориентиром.

Мнение редакции dzen.guru

Anthropic сделала ход, который выглядит зрело, но вызывает обоснованные вопросы. Критики, по данным источника, называют схему Амодеи «планом уклониться от ответственности за поведение ИИ-моделей» через самоуправляемый контроль. Anthropic на это отвечает: «Эти оценщики не снижают нашу ответственность, а помогают сделать её более проверяемой. Безопасность наших моделей остаётся нашей ответственностью». На мой взгляд, проблема не в самой идее, а в отсутствии стандартов. Anthropic сама признаёт, что правил доступа и коммуникации для аудиторов пока нет. Миллиард долларов за пять лет звучит внушительно, но без публичных критериев успеха невозможно понять, работает ли контроль или создаёт иллюзию. Авторам и маркетологам я бы рекомендовал сегодня одно действие: зафиксируйте в рабочих заметках, какую именно модель вы используете и какой версии, чтобы при смене фильтров или поведения вы могли отследить, что изменилось.

Частые вопросы

Программа аудита повлияет на работу Claude прямо сейчас?

Нет. Аудиторы Faculty только начинают работу внутри Anthropic. Изменения в поведении моделей, если они будут, проявятся позже и, вероятно, при выходе новых версий.

Можно ли скачать приложение Claude by Anthropic в России?

Приложение Claude by Anthropic доступно в App Store и Google Play, но для регистрации и полноценной работы из России обычно нужен VPN и платёжная карта зарубежного банка. Бесплатный тариф позволяет попробовать базовую модель.

Чем встроенный аудитор отличается от обычного внешнего тестирования?

Внешнее тестирование означает, что исследователи получают доступ к модели снаружи и проверяют её ответы. Встроенный аудитор работает внутри компании: видит процессы, код, команду, а не только готовый продукт. Anthropic сравнивает это с допуском инспектора на производство, а не с проверкой товара на полке.

Поделиться:TelegramVK
Игорь Градов
Игорь Градов

Основатель dzen.guru. Эксперт по монетизации и продвижению на Дзен. Автор курса «Старт на Дзен 2026».

Комментарии

Читайте также

World models в ИИ собирают сотни миллионов, но скрывают продукты: логика «тёмного леса»
ai

World models в ИИ собирают сотни миллионов, но скрывают продукты: логика «тёмного леса»

Компании, стоящие за world models в ИИ, привлекли сотни миллионов долларов, но упорно молчат о том, что именно строят, и у этой секретности есть рациональное…

4 мин
Google учит рекламу на закрытых сделках: генерация лидов больше не зависит от первого клика
ai

Google учит рекламу на закрытых сделках: генерация лидов больше не зависит от первого клика

Автор Дзена или маркетолог, который льёт рекламу в Google Ads на B2B-продукт, знает главную боль: цикл сделки длинный, клиент не заполняет форму при первом…

5 мин
Правительственный сайт США использовал китайскую нейросеть
ai

Правительственный сайт США использовал китайскую нейросеть

Почему это важно Федеральное агентство США, отвечающее за открытый доступ к документам, использовало модель компании, которую ФБР одновременно обвиняет в краже…

5 мин