Игорь Градов
Игорь Градов
6 мин
ai

Claude Code ищет уязвимости: три ИИ-агента голосуют, прежде чем баг попадёт в отчёт

Anthropic выпустила бета-версию плагина Claude Security для Claude Code, инструмента, который запускает многоагентное сканирование репозитория на уязвимости прямо из терминала разработчика.

Claude Code ищет уязвимости: три ИИ-агента голосуют, прежде чем баг попадёт в отчёт
Почему это важно

Плагин не просто ищет уязвимости, а пропускает каждую находку через независимую верификацию тремя агентами, и только после голосования включает её в отчёт: это снижает долю ложных срабатываний, которые обычно «хоронят» полезность автоматических сканеров.

До сих пор Claude Code работал как помощник для написания и рефакторинга кода. Теперь Anthropic добавила к нему модуль безопасности, который превращает ту же сессию в сканер уязвимостей с генерацией патчей. Плагин устанавливается двумя командами из официального маркетплейса Anthropic, исходный код открыт в репозитории claude-plugins-official, текущая версия 0.10.0.

Что Когда Кто выпустил Цена
Claude Security, плагин для Claude Code Бета, дата точного запуска не названа Anthropic Не раскрыта, входит в сессию Claude Code

Что умеет плагин?

Одна команда /claude-security открывает меню из трёх задач:

  • Сканирование кодовой базы целиком или выбранной части репозитория
  • Сканирование изменений в ветке, пулл-реквесте (запросе на слияние кода) или отдельном коммите (зафиксированном изменении)
  • Генерация патчей (файлов-исправлений) по найденным уязвимостям

Для авторов, далёких от разработки, суть простая: плагин проверяет код «на дыры» и предлагает конкретные заплатки, но применяет их только сам разработчик после ручной проверки.

Шесть фаз сканирования и четыре уровня глубины

Внутри плагин устроен как оркестр из подагентов (ИИ-агент, программа, которая выполняет задачу автономно). JavaScript-скрипт распределяет работу по шести фазам:

  1. Инвентаризация: разбивка репозитория на компоненты, каждая папка либо сканируется, либо пропускается с указанием причины.
  2. Модель угроз: для каждого компонента отдельный агент описывает точки входа, границы доверия и файлы, которые исследователь обязан прочитать полностью.
  3. Исследование: агенты проверяют компоненты по четырём категориям: инъекции и входные данные, авторизация и доступ, память и небезопасные операции, криптография и секреты. Для языков с безопасной памятью (Python, TypeScript) категория «память» автоматически снимается.
  4. Дозаполнение: поиск того, что пропустила основная матрица.
  5. Панель верификации: три независимых проверяющих по трём линзам.
  6. Состязательная проверка: только на максимальном уровне усилий, повторная панель и «красная команда» для каждой выжившей находки.

Глубину сканирования задают четыре уровня: low, medium, high и max. На низком и среднем уровне сканируется до 12 компонентов с одним исследователем на ячейку, на высоком и максимальном лимит вырастает до 24 компонентов и двух исследователей. Количество проходов дозаполнения масштабируется от нуля до двух.

Оркестратор работает на модели Opus, картограф репозитория и ридер кода используют Sonnet. Все сканирующие агенты ограничены режимом «только чтение».

Как находка попадает в отчёт?

Это ключевой момент для понимания, почему Claude Code в связке с этим плагином отличается от обычного линтера (автоматического проверщика кода). Найденная уязвимость не попадает в отчёт просто потому, что агент её обнаружил.

Каждый кандидат передаётся трём независимым верификаторам по линзам: достижимость (REACHABILITY), последствия (IMPACT) и существующие защиты (DEFENSES). Каждый возвращает вердикт TRUE_POSITIVE или FALSE_POSITIVE с указанием конкретного файла и строки. Для включения в отчёт нужен кворум: минимум два из трёх голосов «за». Если ответили меньше трёх верификаторов, находка отклоняется.

Панель ещё и ограничивает заявленную уверенность. Единогласное решение 3 из 3 даёт потолок «высокая уверенность», кворум 2 из 3 ограничивает уровнем «средняя». Подсчёт голосов ведёт Python-рендерер отчёта, а не та же модель, которая нашла уязвимость, поэтому результат можно проверить по записи голосования.

Что записывается на диск?

Каждый скан создаёт папку CLAUDE-SECURITY-<timestamp>/ с тремя файлами:

  • CLAUDE-SECURITY-RESULTS.md: читаемый отчёт с ID находки, уровнем серьёзности (HIGH/MEDIUM/LOW), уверенностью, идентификатором CWE (стандартный каталог типов уязвимостей), конкретной строкой, сценарием эксплуатации и рекомендацией
  • CLAUDE-SECURITY-RESULTS.jsonl: те же данные в машиночитаемом формате
  • CLAUDE-SECURITY-REVISION-.json: штамп ревизии с хешем коммита, уровнем усилий, счётчиками по серьёзности и степенью верификации

Папка содержит собственный .gitignore, чтобы случайный git add не затянул отчёт в коммит. Если нужен аудиторский след, достаточно удалить этот файл.

Патчи проверяются отдельным агентом

Генерация исправлений работает в клоне репозитория, рабочая директория и индекс разработчика остаются нетронутыми. Агент, независимый от того, кто написал патч, проверяет изменения и запускает тесты проекта. Патч записывается только если верификатор подтверждает все три условия: изменение устраняет конкретную находку, не вносит новых уязвимостей и не меняет поведение программы.

Как установить за две команды?

  1. Откройте сессию Claude Code в терминале и введите: /plugin install claude-security@claude-plugins-official, затем /reload-plugins.
  2. Если маркетплейс не найден, сначала выполните /plugin marketplace add anthropics/claude-plugins-official.
  3. Запустите /claude-security и выберите нужный режим сканирования.

Плагин работает в локальном терминале, никакой облачной привязки к конкретному региону нет, поэтому разработчики из России и СНГ могут использовать его при наличии доступа к Claude Code.

Есть ли аналоги в российских ИИ-инструментах?

На момент публикации ни YandexGPT, ни GigaChat (российские языковые модели от «Яндекса» и «Сбера» соответственно) не предлагают встроенных плагинов для поиска уязвимостей в коде. Отечественные DevSecOps-команды (специалисты, объединяющие разработку, безопасность и эксплуатацию) обычно используют коммерческие сканеры вроде Positive Technologies или Solar appScreener. Плагин Claude Security не заменяет их, но добавляет дополнительный слой проверки прямо в среде, где пишется код.

Что делать с этим прямо сейчас, по ролям?

Разработчику и DevSecOps-инженеру. Установите плагин и запустите сканирование на уровне medium перед ближайшим коммитом. Четырёхуровневая система усилий позволяет подобрать глубину под размер изменений: для пулл-реквеста хватит low, для аудита модуля перед релизом берите high.

Автору на Дзене, пишущему о технологиях. Тема «ИИ проверяет код на безопасность» даёт конкретный кейс для статьи: можно показать, как Claude Code с плагином находит уязвимость и генерирует патч, это наглядный формат до/после.

Предпринимателю в РФ. Если ваша команда уже использует Claude Code, плагин добавляет сканирование без дополнительной инфраструктуры. Но учтите: для сертифицированного аудита по российским стандартам он не подойдёт, нужны лицензированные инструменты.

Мнение редакции dzen.guru

Anthropic сделала архитектурно грамотный ход: разделила агента-исследователя и агента-верификатора, а подсчёт голосов вынесла в отдельный код. Это не гарантирует отсутствие ложных срабатываний, но делает процесс прозрачным и проверяемым, чего не хватает большинству ИИ-инструментов для безопасности.

Оговорка: плагин в бета-версии, его нельзя воспринимать как замену полноценному пентесту или сертифицированному сканеру. Он ищет типовые уязвимости по четырём категориям, экзотические сценарии атак может пропустить.

Я бы рекомендовал попробовать его на небольшом проекте: запустите /claude-security с уровнем low, посмотрите на отчёт и оцените, насколько находки релевантны вашему стеку. Это займёт десять минут и покажет, стоит ли встраивать инструмент в рабочий процесс.

Частые вопросы

Плагин меняет мой код автоматически?

Нет. Сканирование работает в режиме «только чтение». Патчи генерируются в отдельном клоне репозитория, а применяет их разработчик вручную после проверки.

Нужна ли платная подписка Claude для установки?

Плагин работает внутри сессии Claude Code. Отдельная цена за плагин не объявлена, но для запуска Claude Code нужен доступ к API Anthropic. Бесплатного варианта на момент публикации компания не анонсировала.

Можно ли использовать плагин из России?

Технически плагин устанавливается локально из терминала и не привязан к региону. Ограничения могут касаться доступа к самому Claude Code и API Anthropic, это зависит от текущей политики компании и способа оплаты.

Поделиться:TelegramVK
Игорь Градов
Игорь Градов

Основатель dzen.guru. Эксперт по монетизации и продвижению на Дзен. Автор курса «Старт на Дзен 2026».

Комментарии

Читайте также

Локальные нейросети на Mac mini M4 Pro: полная настройка за 30 минут без облака
ai

Локальные нейросети на Mac mini M4 Pro: полная настройка за 30 минут без облака

Mac mini с чипом M4 Pro и 48 ГБ общей памяти позволяет развернуть локальные нейросети и подключить к ним персонального ИИ-агента OpenClaw без облачных подписок…

6 мин
Google Gemini получила три новые модели, но без флагманской Pro догоняет конкурентов
ai

Google Gemini получила три новые модели, но без флагманской Pro догоняет конкурентов

Google представила сразу три новые модели семейства Gemini, сделав ставку на скорость и низкую цену, но так и не выпустила долгожданную версию Pro, которая…

5 мин
Yope привлёк $12,3 млн: приватная социальная сеть без рекламы набрала 15 млн пользователей
ai

Yope привлёк $12,3 млн: приватная социальная сеть без рекламы набрала 15 млн пользователей

Yope, приватная соцсеть без алгоритмов и рекламы, привлекла 12,3 млн долларов в раунде, который возглавил Northzone, инвестор Spotify и Klarna, и теперь…

5 мин