Двухслойное ai код ревью: два агента ловят баги, которые один пропускает
Нейросети уже умеют не только писать код по описанию задачи, но и рецензировать его, и если выстроить процесс правильно, качество вырастает заметно даже для тех, кто пишет код в режиме «вайб-кодинга», то есть просто описывая задачу словами и доверяя ИИ-агенту всю реализацию.

Ниже разберём конкретную схему двухслойного ai код ревью, где два разных ИИ-агента с разными ролями проверяют каждый кусок кода до того, как он попадёт в финальный продукт.
Один ИИ-агент, который и пишет, и проверяет собственный код, неизбежно воспроизводит свои же слепые зоны: тесты проходят, но архитектура гниёт, зависимости устаревают, а дыры в безопасности остаются незамеченными. Двухконтурная проверка разными моделями ломает этот порочный круг.
Автор подхода адаптировал фреймворк GSD (get-shit-done, «бери и делай», методология автономной разработки с ИИ-агентами) и встроил в него двух независимых рецензентов: Grok и Codex. Grok (модель от xAI с доступом к живому вебу) выступает «расширителем горизонта», а Codex (инструмент от OpenAI) работает как строгий экзаменатор. Основным исполнителем при этом остаётся Claude Code, но сама архитектура не привязана к конкретной модели.
Что понадобится?
- Claude Code или другой ИИ-агент-исполнитель, способный работать через командную строку
- Grok (доступ к API xAI или через веб-интерфейс) для поиска рисков через живой веб
- Codex CLI (OpenAI) для архитектурной критики кода
- Два shell-скрипта:
grok.shиcodex.sh, которые GSD вызывает как дочерние процессы - Git для работы с диффами (разницей между версиями кода)
- Примерно 30 минут на настройку скриптов и конфигов при первом запуске
Пошаговая инструкция
-
Опишите проект и получите план. Передайте ИИ-агенту (Claude Code) описание задачи. GSD автоматически разобьёт проект на независимые подзадачи и выстроит цикл: исследование, планирование, исполнение, проверка.
-
Запустите Grok первым в режиме расширения. На этом этапе Grok не оценивает план, а дополняет его. Он ищет в реальном вебе то, что вы могли упустить, и возвращает находки в трёх категориях:
[missing-scope] — «Вы забыли про rate limiting!»
[alt-approach] — «А давайте вынесем это в очередь!»
[external-risk] — «У этой зависимости свежая CVE (публично известная уязвимость)!»
Валидные предложения вплетаются в план. Настоящие развилки оформляются как вопросы к вам.
-
Передайте обогащённый план Codex в режиме оценки. Codex выносит короткий вердикт:
SOLID(план крепкий) илиWEAKNESSES(n)с пронумерованным списком слабых мест. Он ищет циклические зависимости, нарушения принципов KISS (не усложняй) и DRY (не повторяйся), размытые критерии приёмки. -
Исправьте план по замечаниям Codex и запустите исполнение. Claude Code берётся за код, работая порциями (слайсами). Каждый слайс сначала проходит механическую проверку: тесты и линтеры (автоматические анализаторы стиля кода).
-
На каждый готовый слайс натравите обоих рецензентов параллельно. Это ключевой момент ai код ревью:
# GSD автоматически вызывает оба скрипта, передавая git diff через stdin
./grok.sh < diff_slice.md # проверяет актуальность библиотек, безопасность, краевые баги
./codex.sh < diff_slice.md # проверяет корректность, регрессии, архитектурную чистоту
Каждый рецензент возвращает либо APPROVE, либо COMMENTS(n) с привязкой к конкретному файлу и строке. Каждое замечание имеет индекс важности: блокер, минорное замечание или «нит» (мелочь, стилистика).
- Объедините находки, уберите дубли, отправьте Claude на исправление. Агент чинит слайс за один проход. Как только слайс получил «зелёный свет» от обоих рецензентов, GSD переходит к следующему.
Допустим, вы пишете Telegram-бота для автопостинга в Дзен. Claude Code сгенерировал модуль авторизации. Механические тесты прошли. Вы запускаете двойное ревью:
Grok находит: зависимость python-telegram-bot версии 13.x устарела, в актуальной 21.x изменился API; у библиотеки для OAuth обнаружена свежая уязвимость CVE-2025-XXXXX.
Codex находит: логика повторного запроса токена дублируется в трёх местах (нарушение DRY), обработка ошибок сети отсутствует, при таймауте бот падает молча.
Claude получает объединённый список, обновляет зависимость, выносит повторяющуюся логику в отдельную функцию, добавляет обработку таймаутов. Повторное ревью: оба рецензента выдают APPROVE. Слайс закрыт, можно двигаться дальше.
Запускать обоих рецензентов одновременно на этапе плана. Grok должен идти первым и расширять, Codex вторым и сужать. Параллельный запуск на плане приводит к потере времени: Codex критикует черновик, который Grok ещё не успел дополнить.
Проверять только в конце, а не после каждого слайса. Если копить код и проверять весь релиз разом, замечания накапливаются лавиной, а исправления ломают соседние модули. Итеративная проверка порциями обходится дороже по токенам, но дешевле по нервам и времени.
Слепо доверять результату. Автор подхода честно предупреждает: это усиленный, но всё равно вайб-кодинг. Для критически важных систем (финансы, медицина, безопасность) двойное ai код ревью нейросетями не заменяет ручную проверку человеком.
Забыть про стоимость. Каждый вызов рецензента расходует токены (единицы текста, за которые платят при обращении к модели). На проекте из десятков слайсов расходы вырастают заметно.
Что делать с этим прямо сейчас?
Авторам Дзена и копирайтерам, которые используют ИИ для генерации скриптов автоматизации (парсеры, боты, автопостинг): даже без знания программирования вы можете попросить второй ИИ (например, Grok через веб) проверить код, который сгенерировал первый. Просто вставьте код и попросите: «Найди уязвимости, устаревшие зависимости и дублирование логики».
Маркетологам, которые заказывают разработку у фрилансеров или ИИ-агентов: двухслойное ревью даёт аргументированный чек-лист для приёмки. Вы получаете не субъективное «вроде работает», а структурированный протокол с привязкой замечаний к строкам.
Предпринимателям в РФ и СНГ: Grok доступен через VPN, Codex CLI работает через API OpenAI (тоже потребуется обходной путь для оплаты и доступа). Из полностью доступных в России альтернатив для роли рецензента можно попробовать YandexGPT или GigaChat, хотя их способности к анализу кода на данный момент скромнее.
Сам подход «два рецензента с разными характерами» кажется мне самой ценной идеей здесь, причём применимой далеко за пределами кода. По сути, это тот же принцип, который мы в dzen.guru используем для текстов: один ИИ генерирует, другой критикует, третий ищет фактические ошибки. Но честная оговорка: настройка скриптов и CLI требует хотя бы минимального знакомства с терминалом. Если вы никогда не открывали командную строку, начните с простого варианта: скопируйте код в чат Grok, попросите найти проблемы, затем перенесите находки в Claude или ChatGPT для исправления. Это ручной аналог того же двухконтурного процесса, медленнее, но работает без настройки.
Главное, что стоит забрать из этой схемы: не доверяйте одной нейросети проверять саму себя. Два разных взгляда ловят то, что один гарантированно пропустит, и это правило работает одинаково для кода, для текстов и для любых задач, где цена ошибки выше нуля.
Научитесь работать с ИИ-инструментами системно
В dzen.guru мы разбираем практические связки нейросетей для авторов и предпринимателей, от генерации контента до автоматизации рутины
Попробовать dzen.guru
Основатель dzen.guru. Эксперт по монетизации и продвижению на Дзен. Автор курса «Старт на Дзен 2026».
Читайте также

Обучение нейросети с нуля на текстах Warhammer 40K: бесплатный гайд с кодом на Хабре
Почему это важно Русскоязычный практический разбор того, как собрать и предобучить собственную языковую модель с нуля, от токенизатора до запуска, появляется…

Greenfield и brownfield в разработке систем искусственного интеллекта: где ИИ-ассистенты бессильны
Компания или автор не указаны, источник представляет собой экспертный гайд без привязки к конкретному релизу или дате. Работаю строго по фактам из переданного…

Интерфейсы мозг-компьютер без операции: кто конкурирует с Neuralink и почему это дешевле
Интерфейсы мозг-компьютер работают не только у Neuralink: носимые ЭЭГ-устройства китайских и российских разработчиков уже помогают восстанавливать движения…
Комментарии