Игорь Градов
Игорь Градов
6 мин
ai

Grok Imagine 2.0 делает ставку на редактирование: 9 форматов, 5 референсов и $0,05 за запрос

Grok Imagine 2.0 позволяет точечно править отдельные области изображения, загружать до пяти референсов в одном запросе и автоматически подгонять картинку под девять форматов, от сторис до баннера, без ручной перегенерации всего кадра.

Grok Imagine 2.0 делает ставку на редактирование: 9 форматов, 5 референсов и $0,05 за запрос
Почему это важно

xAI сместила фокус с генерации «красивых картинок по промпту» на итеративную работу: правка области, удаление фона, умный ресайз. Для тех, кто каждый день адаптирует один креатив под пять площадок, это экономия реальных часов.

Компания xAI выпустила Grok Imagine Image 2.0. Обновление генератора изображений, встроенного в чат-бот Grok, впервые делает ставку не на качество первой генерации, а на удобство доработки уже готового кадра. По данным источника, модель заняла второе место в бенчмарке Arena (рейтинг генеративных моделей по слепому голосованию пользователей).

Что понадобится?

  • Доступ к API: на момент публикации модель в статусе Preview доступна через Vercel AI Gateway. Стоимость одной генерации составляет $0,05
  • Промпт (текстовое описание задачи для модели): достаточно базового описания на английском языке; русский язык модель понимает, но результат менее стабилен
  • Исходные изображения: если планируете редактировать, а не генерировать с нуля, подготовьте файлы заранее (до пяти штук)
  • Время: первая генерация занимает заметно больше, чем у Nano Banano 2, но быстрее, чем у GPT Image 2

Пошаговая инструкция

  1. Откройте Grok Imagine через интерфейс Grok или подключитесь к API через Vercel AI Gateway. Имя модели для запроса:
xai/grok-imagine-image-2.0-preview
  1. Сгенерируйте базовое изображение обычным текстовым промптом. Опишите сцену, стиль, композицию. Модель обучена «планировать типографику и раскладку как дизайнер», по формулировке xAI, поэтому можно сразу задавать плотные многоэлементные сцены.

  2. Точечно отредактируйте нужную область. Инструмент Magic Wand (автоматическое выделение) позволяет указать конкретный участок кадра. Модель перерисует только его, не трогая остальное. Если нужна более точная выборка, используйте Segmentation (сегментация, разбиение изображения на отдельные зоны), чтобы выбрать объект вручную.

  3. Удалите фон, если нужен объект на прозрачном слое. Функция Background Removal экспортирует результат в PNG с прозрачностью, готовый для вставки в баннер или карточку товара.

  4. Загрузите референсы для сложной композиции. В одном запросе Grok Imagine принимает до пяти изображений: продукт, модель, фон, логотип, стилевую палитру. Раньше лимит составлял три изображения; расширение до пяти снимает необходимость склеивать элементы вручную в графическом редакторе.

  5. Адаптируйте кадр под нужный формат через Smart Resize. Выберите соотношение сторон, модель достроит недостающие части изображения, а не обрежет существующее. Поддерживаются девять форматов:

  6. 1:2 и 2:1
  7. 9:16 и 16:9
  8. 2:3 и 3:2
  9. 3:4 и 4:3
  10. 1:1

  11. Используйте готовые шаблоны. В релизе 15 шаблонов под типовые задачи. Идея: не собирать промпт с нуля, а подставить свои входные данные в уже настроенный рабочий процесс.

Кириллица и русский язык: что показал тест?

Источник протестировал генерацию по промпту на русском языке. Результат: модель обрабатывает русскоязычные описания, но детализированные промпты на английском дают более предсказуемый результат. В тесте с воспроизведением кириллического текста на развороте книги (промпт требовал читаемый текст Достоевского) модель справилась, хотя качество передачи мелких символов стоит проверять в каждом конкретном случае.

Сколько стоит генерация и при чём тут конкуренты?

По данным источника, стоимость одного запроса к Grok Imagine Image 2.0 Preview через Vercel AI Gateway составляет $0,05. Для сравнения:

  • Seedream 5 Pro: $0,0675
  • Nano Banano 2: $0,08
  • GPT Image 2: примерно $0,18

Даже если по API будут доступны не все функции редактирования (а пока это Preview-версия), цена делает модель привлекательной для массовой генерации. Источник отмечает, что «китайские модели пока не дотягивают до уровня Nano Banano 2», а Grok Imagine при меньшей цене показывает сопоставимое качество.

Характерная деталь: компания Reve ранее предлагала похожий набор функций послойного редактирования, но только внутри собственного интерфейса. По API были доступны лишь базовые режимы «текст в изображение» и «изображение в изображение». В итоге Reve прекратила предоставление модели через API. Как xAI решит этот вопрос для полной версии, пока не объявлено.

Что делать с этим прямо сейчас?

Авторам Дзена и контент-мейкерам. Smart Resize решает ежедневную задачу: один удачный кадр нужно подать горизонтально в ленте, вертикально в сторис и квадратом в карточке. Вместо трёх заходов в редактор хватит одного запроса.

Маркетологам и дизайнерам. Multi-reference до пяти изображений (загрузка нескольких образцов для одной генерации) позволяет собрать рекламный креатив из готовых элементов: лого, фото продукта, фон, стилевая палитра. Без ручного монтажа слоёв.

Предпринимателям в РФ и СНГ. На момент публикации модель доступна только в Preview через Vercel AI Gateway. Прямого доступа из российских сервисов пока нет. По данным источника, полный релиз ожидается в ближайшие дни, после чего модель появится на сторонних платформах. Из доступных в РФ генераторов изображений можно присмотреться к Kandinsky от «Сбера» и генератору YandexART, хотя функции послойного редактирования у них ограничены.

Пример: промпт и результат

Источник показал генерацию по следующему промпту:

Реклама фотографа. Черно-белый снимок для обложки журнала.
Флэтлай камер, объективов, полароидных снимков и аксессуаров
профессионального фотографа. Без надписей.

Результат: модель выдала плотную композицию в формате флэтлей с корректным расположением объектов, без артефактов на мелких деталях и без «паразитного» текста, который часто появляется у генеративных моделей при работе с журнальной стилистикой.

Частые ошибки

Промпт на русском для сложных сцен. Модель принимает русский язык, но детальные инструкции (особенно с указанием типографики и мелкого текста) надёжнее формулировать на английском.

Ожидание полного набора функций по API. Сейчас доступна Preview-версия. Какие именно функции (Magic Wand, Segmentation, Smart Resize) работают через API, а какие только в интерфейсе Grok, источник не уточняет. Перед встраиванием в рабочий процесс проверьте на тестовых запросах.

Сравнение скорости с привычными инструментами. Grok Imagine генерирует заметно медленнее Nano Banano 2. Если вы привыкли к мгновенному отклику, закладывайте больше времени на пакетную обработку.

Мнение редакции dzen.guru

Главная ценность Grok Imagine Image 2.0 не в том, что модель «рисует красивее». Ценность в том, что xAI первой из крупных игроков честно признала: первая генерация почти никогда не финальная. Набор инструментов точечной правки, от выделения области до удаления фона с экспортом в PNG, это рабочий конвейер, а не витрина.

Цена $0,05 за запрос при сопоставимом с Nano Banano 2 качестве делает модель кандидатом на «базовую» для массовых задач. Но я бы подождал полного релиза API и проверил, какие функции редактирования реально доступны через код, а не только через интерфейс. История Reve показала, что «всё есть, но только в интерфейсе» убивает модель для продакшена.

Для авторов из РФ пока рано перестраивать процессы: доступа нет. Но протестировать через VPN на небольшой задаче имеет смысл, чтобы к моменту появления на российских платформах уже понимать, подходит ли модель под ваш контент.

Попробуйте генерацию изображений на VEGA

Как только Grok Imagine Image 2.0 появится на платформе, вы сможете протестировать модель без VPN и зарубежных аккаунтов.

Перейти на VEGA
Поделиться:TelegramVK
Игорь Градов
Игорь Градов

Основатель dzen.guru. Эксперт по монетизации и продвижению на Дзен. Автор курса «Старт на Дзен 2026».

Комментарии

Читайте также

Разработка ИИ-агентов для PHP: из пяти моделей задачу решила только одна
ai

Разработка ИИ-агентов для PHP: из пяти моделей задачу решила только одна

Автор протестировал четыре локальных ИИ-агента и один облачный на реальном PHP/Symfony-проекте с мониторингом сайтов, прогнал каждого через функциональные…

6 мин
Генерация лица нейросетью: поэтапная сборка портрета точнее одного промпта
ai

Генерация лица нейросетью: поэтапная сборка портрета точнее одного промпта

Команда Singularis собрала локальный пайплайн (конвейер обработки, где каждый шаг передаёт результат следующему) для генерации лица нейросетью с управлением…

6 мин
ai

Ватермарки для ИИ-текстов стали обязательными в ЕС, но проверить их пока некому

Google второго августа 2026 года активировал обязательную маркировку ИИ-текстов по европейскому AI Act, и Anthropic тут же объявила, что Claude будет вшивать…

6 мин