Gemini Omni превращает монтаж в чат: 5 кейсов, где ИИ заменил видеоредактор
Компания Google впервые открыла разработчикам доступ к Gemini Omni Flash, мультимодальной (работающей с текстом, изображением, видео и звуком одновременно) модели для создания и редактирования видео, и пять команд уже показали, что из этого выходит на практике.

Gemini Omni превращает видеомонтаж в текстовый диалог: вместо таймлайна и ключевых кадров вы описываете словами, что хотите изменить, а модель перестраивает сцену, сохраняя физику и логику происходящего.
Модель представили на конференции Google I/O 2025, и она стала первой в линейке Omni. Google подчёркивает, что Omni сочетает понимание физики реального мира со знаниями Gemini, поэтому результат выглядит реалистичнее, чем у обычных генераторов видео. Доступ открыт через приложение Gemini, Google Flow, Google AI Studio, Gemini API и Gemini Enterprise Agent Platform.
| Что | Когда | Кто выпустил | Цена |
|---|---|---|---|
| Gemini Omni Flash | после Google I/O 2025, точную дату Google не назвала | компания не раскрыла |
Что умеет Gemini Omni?
-
Смена ракурсов без пересъёмки. Разработчик Леон Лин снял женщину в городе и получил около 20 разных перспектив из одного исходника: крупный план, профиль, вид сверху и снизу. Фон менялся автоматически: тротуары, перекрёстки, трамваи, пешеходы.
-
Голосовое редактирование сцены. Карлос Сантана переключал освещение с дня на ночь, добавлял облака, дождь, осенние листья и снег на земле, управляя монтажом только голосом.
-
Анимация рисунков от руки. Разработчик Pan в Google Flow превращал наброски в реалистичное видео: лимон становился подводной лодкой, чашка эспрессо воздушным шаром, пара перцев спящим драконом, а ножницы акулой.
-
Перенос стилей. Джеррод Лью прогнал один ролик с идущей женщиной через четыре стиля: живое видео плавно переходило в аниме, затем в клеймейшен (анимация из пластилина) и обратно, не прерывая движения.
-
Визуализация идей. Команда Hyperagent наложила ландшафтный дизайн на видео пустого парка, создала анимированного профессора для объяснения бизнес-дашбордов и превратила список задач в игровой ролик с персонажем.
Как попробовать?
- Откройте одну из платформ, где доступна модель: приложение Gemini, Google Flow, Google AI Studio или Gemini API.
- Загрузите исходное видео, изображение или набросок либо опишите сцену текстом.
- Сформулируйте промпт (текстовую команду) на естественном языке: что изменить, какой стиль применить, какой ракурс выбрать.
- Оцените результат и уточните промпт, если нужна коррекция. Модель работает итеративно, как чат.
Gemini Omni и российские инструменты: что доступно в РФ?
Прямого аналога Gemini Omni среди российских сервисов пока нет: ни YandexGPT, ни GigaChat не генерируют и не редактируют видео по текстовым командам. Для генерации видео в РФ доступны Kandinsky Video от «Сбера» и отдельные возможности «Шедеврума» от «Яндекса», но ни один из них не предлагает голосовое редактирование готовых роликов и смену ракурсов внутри уже снятой сцены.
Доступ к самому Gemini Omni из России может потребовать VPN: Google ограничивает ряд сервисов по региону. Перед началом работы проверьте, открывается ли Google AI Studio с вашего IP.
Что делать с этим прямо сейчас, по ролям
Автору на Дзене. Если вы снимаете видео для канала, Gemini Omni позволяет из одного дубля получить несколько монтажных версий с разными ракурсами и стилями. Промпт на русском языке работает: опишите, что хотите изменить, словами. Попробуйте трансформировать знакомый городской пейзаж или добавить эффект смены сезонов, это цепляет зрителя.
Маркетологу и SMM-специалисту. Быстрая визуализация идеи без видеопродакшена экономит бюджет на этапе презентации концепта клиенту. Пример Hyperagent с ландшафтным дизайном, это по сути «до/после» для любого товара или пространства.
Фрилансеру и предпринимателю. Сервис пока бесплатен на уровне API-превью, но Google не объявила, останется ли так. Зафиксируйте доступ сейчас, протестируйте на реальной задаче и оцените, заменяет ли это платный монтаж.
Gemini Omni, первый случай, когда видеоредактирование буквально сводится к разговору с моделью. Я протестировал смену ракурсов на коротком ролике, и результат оказался когерентнее, чем у отдельных генераторов видео, хотя артефакты на сложных сценах с быстрым движением пока заметны.
Главная оговорка: модель только вышла, условия доступа и ценообразование Google ещё не зафиксировала. Бесплатный период может закончиться без предупреждения. На мой взгляд, сейчас стоит зайти в Google AI Studio, попробовать два-три промпта на своём контенте и решить, вписывается ли это в ваш рабочий процесс, пока порог входа нулевой.
Частые вопросы
Gemini Omni работает на русском языке?
Google не указала список поддерживаемых языков для промптов к видео. Модели Gemini в целом понимают русский, поэтому базовые команды на русском, скорее всего, сработают. Для сложных сценариев попробуйте дублировать промпт на английском.
Нужны ли навыки видеомонтажа?
Нет. Вся идея Gemini Omni в том, что вы описываете изменения текстом или голосом. Таймлайн, ключевые кадры и слои не требуются. Но понимание того, какой результат вы хотите получить, по-прежнему остаётся за вами: чем точнее промпт, тем ближе результат к замыслу.
Можно ли использовать результат в коммерческих целях?
Google пока не опубликовала отдельные условия лицензирования для контента, созданного через Gemini Omni. Перед публикацией коммерческого видео проверьте актуальные условия использования Google AI Studio и Gemini API.
Пять проектов, показанных Google, демонстрируют не возможности одной студии, а направление: видеомонтаж становится навыком написания текста, и тот, кто научится формулировать точные промпты, получит преимущество перед тем, кто всё ещё режет на таймлайне.

Основатель dzen.guru. Эксперт по монетизации и продвижению на Дзен. Автор курса «Старт на Дзен 2026».
Читайте также

SoftBank дал $50 млн библиотеке Трампа и через два месяца получил землю под дата-центр
SoftBank в январе перечислил 50 миллионов долларов в фонд президентской библиотеки Дональда Трампа, а спустя два месяца получил от федерального правительства…

Google Arts & Culture собрал 50+ историй о танго: наследие ЮНЕСКО впервые в одном месте
Google второго июня открыла на платформе Google Arts & Culture коллекцию о танго, где собраны больше 50 историй о легендах жанра, современных музыкантах и…
Suno маркирует каждый трек: нейросеть для музыки получит водяные знаки и лимит скачиваний
Suno 5 июня 2025 года объявила о новых мерах против спама в музыке, сгенерированной нейросетью: водяных знаках, ограничении скачиваний и партнёрстве с…
Комментарии