IBM Bob вышел в режиме self-hosted: разработка ИИ-агентов теперь возможна без облака
IBM Bob теперь можно развернуть внутри собственной инфраструктуры, и для российских компаний, которым запрещено отправлять код и данные в чужое облако, это один из немногих способов получить полноценную агентную платформу разработки без компромиссов по безопасности.
IBM впервые сделала свою агентную платформу для разработки доступной в режиме полной изоляции от интернета, а значит, банки, госструктуры и предприятия с закрытым контуром могут запустить ИИ-агента (программу, которая сама анализирует код, планирует задачи и вносит изменения) прямо на своих серверах.
До сих пор большинство платформ для разработки ИИ-агентов требовали облачного подключения: код и контекст проекта уходили на серверы вендора. IBM объявила о общей доступности (GA, то есть продукт вышел из тестирования и открыт всем корпоративным клиентам) варианта развёртывания Bob на собственных мощностях заказчика. Источник: IBM, публикация о GA-релизе Bob self-hosted.
Что входит в самостоятельное развёртывание?
Bob покрывает полный цикл работы с кодом:
- Понимание существующей кодовой базы
- Планирование задач
- Внесение изменений
- Проверка результатов
Платформу можно поставить на собственные серверы, в частное или суверенное облако и даже в сети без выхода в интернет (air-gapped, то есть физически изолированные от внешнего мира контуры). Набор функций при этом остаётся тем же: среда разработки в IDE (редакторе кода), командная оболочка BobShell, параллельный вызов инструментов, агентная обвязка, навыки и режимы работы.
Отдельно IBM предлагает премиум-пакеты для модернизации Java-приложений, систем IBM i и мейнфреймов IBM Z. Именно работа с legacy-кодом (унаследованным кодом, который писали десятилетиями и который дорого переписывать) выделяет Bob на фоне конкурентов: GitLab и GitHub встраивают агентов в свои DevOps-платформы, Mistral привязывает агента к собственным моделям с открытыми весами (open weights, когда параметры модели можно скачать и запустить локально), а IBM целится в длинные кодовые базы внутри закрытых контуров.
Модель не включена, и это принципиально
Bob в варианте self-hosted не содержит языковой модели. Заказчик сам выбирает, лицензирует и размещает модель из списка поддерживаемых IBM. Формат называется BYOL (Bring Your Own License, «принеси свою лицензию»).
IBM делит модели по способу развёртывания:
- Полная изоляция. Модели вроде Nemotron или Poolside Laguna разворачиваются внутри контура заказчика. Код, контекст разработки и артефакты сборки не покидают периметр.
- Гибридный режим. Часть задач можно маршрутизировать на внешние модели (Claude, Gemini или GPT), если политика безопасности это допускает.
IBM приводит конкретный пример: банк может запускать инференс (процесс, при котором модель обрабатывает запрос и выдаёт результат) для основных банковских приложений на собственных серверах, а менее чувствительные задачи отправлять на одобренную внешнюю модель. Разработчики видят одинаковый интерфейс Bob в обоих случаях, а команды безопасности контролируют архитектуру под капотом.
IBM также анонсировала планы по расширению списка моделей и добавлению мультимодельной маршрутизации (когда платформа сама выбирает, какую модель задействовать для конкретной задачи). Но это пока план, а не готовая функция.
Что понадобится для запуска?
- Корпоративная подписка IBM Bob (цену IBM не публикует, направляет на запрос демо)
- Собственная инфраструктура: серверы для размещения платформы и модели
- Лицензия на одну из поддерживаемых моделей (Nemotron, Poolside Laguna или другую из списка IBM)
- Поддерживаемая IDE-среда
- Время: развёртывание зависит от масштаба инфраструктуры, но платформа уже в статусе GA, значит, документация и поддержка доступны
Пошаговая инструкция: как начать разработку ИИ-агентов локально
-
Оставьте запрос на демо на сайте IBM Bob. Цены и условия лицензирования IBM обсуждает индивидуально.
-
Выберите модель из списка поддерживаемых. Для полной изоляции подходят Nemotron и Poolside Laguna. Для гибридного режима можно подключить Claude, Gemini или GPT.
-
Подготовьте инфраструктуру. Определите, какие задачи останутся внутри контура, а какие допустимо маршрутизировать наружу. Это решение принимают команды безопасности, не разработчики.
-
Разверните Bob в своей среде. Платформа поддерживает on-premises (собственные серверы), частное облако и air-gapped сети.
-
Настройте IDE-интеграцию. Bob работает через привычный редактор кода, разработчикам не нужно менять рабочую среду.
-
Запустите пилотный проект. IBM рекомендует начинать с модернизации legacy-кода, где агент приносит наибольшую пользу.
Допустим, банк с закрытым контуром хочет модернизировать Java-приложение десятилетней давности. Команда разворачивает Bob на собственных серверах, подключает модель Nemotron локально. Разработчик открывает проект в IDE, Bob анализирует кодовую базу, предлагает план рефакторинга, вносит изменения и прогоняет проверку. Весь код и контекст остаются внутри периметра банка. Параллельно другая команда того же банка работает над внутренним чат-ботом для сотрудников, задача не секретная, и для неё Bob маршрутизирует запросы на внешнюю модель Claude. Разработчики в обоих случаях видят одинаковый интерфейс.
Думать, что модель идёт в комплекте. Bob self-hosted не содержит модели. Без лицензии на Nemotron, Poolside Laguna или другую поддерживаемую модель платформа не заработает. Бюджет на модель нужно закладывать отдельно.
Путать «гибридный режим» с «безопасным». Гибридный режим означает, что часть данных уходит на внешние серверы. Если регулятор запрещает любую передачу данных наружу, используйте только локальные модели.
Ожидать мультимодельную маршрутизацию сейчас. IBM анонсировала эту функцию как план, не как готовый продукт. Строить архитектуру вокруг неё рано.
Игнорировать вопрос доступности в РФ. IBM не указала ограничений по регионам для self-hosted варианта, но лицензирование моделей (Nemotron от NVIDIA, Poolside Laguna) может быть затруднено из-за санкционных ограничений. Проверяйте условия лицензии каждой модели отдельно.
Что это значит для вас по ролям?
Разработчику в банке или госструктуре Bob решает главную боль: разработка ИИ-агентов внутри закрытого контура без передачи кода наружу. Если ваш проект связан с legacy-кодом на Java или мейнфреймах, премиум-пакеты IBM заточены именно под это.
Маркетологу и руководителю продукта. Появление локальных агентных платформ означает, что аргумент «ИИ нельзя, у нас закрытый контур» перестаёт работать. Пора пересматривать, какие процессы можно автоматизировать.
Предпринимателю в РФ и СНГ. Прямой доступ к IBM Bob может быть ограничен. Из доступных в РФ направлений для разработки ИИ-агентов локально стоит рассмотреть связку из YandexGPT или GigaChat с открытыми фреймворками. Подход тот же: модель на своих серверах, агентная обвязка поверх, данные не покидают периметр.
IBM сделала правильный ход, отделив платформу от модели. Формат BYOL даёт заказчику свободу, но одновременно перекладывает на него ответственность за выбор, лицензирование и поддержку модели. Для крупных компаний с выделенной командой инфраструктуры это нормально, для среднего бизнеса может оказаться слишком дорого и сложно.
По моим наблюдениям, главное ограничение локальных агентных платформ сегодня не софт, а железо: модели уровня Nemotron требуют серьёзных GPU-мощностей, и стоимость инфраструктуры может превысить стоимость самой лицензии. Перед запуском пилота посчитайте TCO (полную стоимость владения), а не только цену подписки.
Для компаний, которые обязаны держать код и данные внутри периметра, выбор сужается до платформ с локальным развёртыванием. Bob вошёл в этот список, и теперь вопрос не «можно ли запустить ИИ-агента на своих серверах», а «хватит ли мощностей и бюджета, чтобы он работал так же быстро, как в облаке».
Хотите научиться работать с ИИ-инструментами для контента?
В dzen.guru мы разбираем практические сценарии использования нейросетей для авторов и маркетологов, от промптов до автоматизации рутины.
Попробовать инструменты dzen.guru
Основатель dzen.guru. Эксперт по монетизации и продвижению на Дзен. Автор курса «Старт на Дзен 2026».
Читайте также

ChatGPT запустил примерку одежды по фото: OpenAI идёт за рынком Google и Pinterest
ChatGPT второго июня получил виртуальную примерку одежды и аксессуаров прямо в чате, и теперь любой пользователь может загрузить своё фото и увидеть, как вещь…
Prime Intellect запустила serverless ИИ на Blackwell: триллион токенов в день и 100% аптайм
Компания Prime Intellect запустила Prime Inference, платформу для запуска открытых моделей в режиме serverless ИИ, которая до публичного релиза обрабатывала…
Microsoft выпустила нейросеть для распознавания речи: первое место среди 38 моделей при WER 2,5%
Microsoft первого октября выпустила MAI Transcribe 2 Streaming, свою первую нейросеть для распознавания речи в реальном времени, которая, по независимым…
Комментарии