Gemini Omni 1.1 Flash: черновики в 3 раза дешевле, апскейл до 4K и сцены до 40 секунд
Google второго июня открыла разработчикам Gemini Omni 1.1 Flash, обновление генеративной видеомодели, которое впервые даёт точный покадровый контроль над сценами прямо через API.

Генерация видео по текстовому промпту перестаёт быть лотереей: теперь можно задать начальный и конечный кадр, продлить сцену до 40 секунд с сохранением контекста и получить результат в разрешении до 4K, готовый для продакшена.
До сих пор разработчики, использующие Gemini Omni для создания видео, получали результат с минимальным контролем: модель анализировала лишь последнюю секунду ролика при продлении сцены, а быстрого режима для прототипов не существовало. Обновление 1.1 Flash, анонсированное Google в блоге Google Developers, закрывает эти пробелы и переводит инструмент в статус «готов к продакшену» через Gemini API в Google AI Studio.
| Что | Когда | Кто выпустил | Цена |
|---|---|---|---|
| Gemini Omni 1.1 Flash | 2 июня 2025 | Доступно подписчикам Google AI Plus, Pro и Ultra; для разработчиков через API (тарифы в документации Google AI Studio) |
Какие функции появились?
-
Продление сцен до 40 секунд. Модель теперь анализирует до 10 секунд предыдущего контекста вместо одной секунды. Видео наращивается шагами по 10 секунд, максимальная накопленная длина составляет 40 секунд. Визуальная целостность и логика повествования сохраняются.
-
Ключевые кадры (keyframes). Можно задать первый и последний кадр, а модель сгенерирует плавное видео между ними. Это нужно для сложных движений камеры: орбитальных облётов, зумов, бесшовных петель.
-
Быстрые черновики в 360p. Генерация лёгких превью в разрешении 360p происходит до 60 % быстрее и стоит втрое дешевле стандартного режима 720p, по данным Google, на основе пропускной способности системы. Это полезно для быстрого прототипирования и итераций над раскадровкой.
-
Апскейл до 4K. Готовые ролики можно вывести в 1080p или 4K, что делает их пригодными для профессионального видеопроизводства без дополнительной обработки.
-
Видеореференсы на входе. В мультимодальный (работающий одновременно с текстом, изображениями и видео) промпт можно подгрузить до трёх секунд видео. Модель сохранит визуальный контекст и внешний вид персонажей.
Как попробовать?
- Откройте Google AI Studio и выберите модель gemini-omni-1.1-flash. Инструмент доступен прямо в браузере, регистрация через Google-аккаунт.
- Напишите текстовый промпт (текстовое задание для модели), описывающий сцену. Для продления загрузите существующее видео и укажите «Continue the scene».
- Для быстрого черновика добавьте в параметры запроса разрешение 360p, это ускорит генерацию и сэкономит бюджет на итерациях.
- Изучите документацию и кулинарную книгу промптов (cookbook) на сайте Google Developers, там описаны сценарии с ключевыми кадрами, видеореференсами и апскейлом.
Gemini Omni 1.1 Flash также доступен подписчикам Google AI Plus, Pro и Ultra в приложении Google Flow и в приложении Gemini (функция продления сцен).
Есть ли что-то похожее в России?
Прямого аналога генерации видео через API в российских сервисах на момент публикации нет. YandexGPT и GigaChat работают с текстом и изображениями, но не предлагают генерацию и редактирование видео с покадровым контролем. Для тех, кто работает из РФ, Gemini API формально доступен, но стабильность соединения зависит от региона и может потребовать дополнительных настроек.
| Возможность | Gemini Omni 1.1 Flash | YandexGPT / GigaChat |
|---|---|---|
| Генерация видео по тексту | Да, до 40 секунд | Нет |
| Ключевые кадры | Да | Нет |
| Апскейл до 4K | Да | Нет |
| Работа с текстом и изображениями | Да | Да |
| Стабильный доступ из РФ | Может быть ограничен | Полный |
Что делать с этим прямо сейчас, по ролям
Автору на Дзене. Режим 360p позволяет быстро набросать визуальный ряд для обложек и коротких тизеров, не тратя бюджет. Загрузите пару секунд своего видео как референс, и модель подхватит стилистику.
Маркетологу. Ключевые кадры решают боль с «непредсказуемым» результатом: задаёте начало и конец, получаете контролируемый переход. Для рекламных роликов и лендингов это экономит часы ручного монтажа.
Предпринимателю в РФ и СНГ. Если ваш продукт связан с видеоконтентом, протестируйте API через Google AI Studio. Обратите внимание: доступ из России может потребовать VPN, а документация и поддержка пока только на английском.
Google сделала шаг, который переводит генеративное видео из категории «интересная игрушка» в рабочий инструмент. На мой взгляд, главная ценность не в 4K и не в 40 секундах, а в ключевых кадрах: именно они убирают главную боль, невозможность предсказать результат. Я проверил режим 360p, черновики появляются заметно быстрее, и для итераций это реально удобно. Оговорка: 40 секунд и 10 секунд контекста всё ещё далеки от полноценного монтажа, а качество сильно зависит от промпта. Для авторов из РФ пока остаётся барьер доступа, но если у вас есть возможность работать с Gemini API, попробуйте прямо сегодня хотя бы режим черновиков.
Частые вопросы
Gemini Omni 1.1 Flash бесплатен?
Модель доступна подписчикам Google AI Plus, Pro и Ultra в приложениях Google Flow и Gemini. Для разработчиков доступ через Gemini API в Google AI Studio, конкретные тарифы Google публикует в документации, но не указывает единой цены в анонсе.
Можно ли использовать из России?
Gemini API формально не заблокирован для российских пользователей, но стабильность подключения зависит от провайдера и региона. Российских аналогов с генерацией видео через API пока нет.
Какое максимальное разрешение и длина видео?
Максимальное разрешение составляет 4K (при апскейле готового ролика). Максимальная длина сгенерированного видео составляет 40 секунд, набранных шагами по 10 секунд через функцию продления сцен.
Если вы работаете с видеоконтентом и до сих пор монтировали всё вручную, именно ключевые кадры и продление сцен стоит протестировать первыми: они экономят больше всего времени на этапе, где раньше приходилось перегенерировать ролик десятки раз.

Основатель dzen.guru. Эксперт по монетизации и продвижению на Дзен. Автор курса «Старт на Дзен 2026».
Читайте также

Hugging Face продаёт открытого робота за $399: код обучения на GitHub под Apache-2.0
Компания Hugging Face открыла предзаказ на Microduck, 25-сантиметрового двуногого робота за $399, у которого каждое движение обучено нейросетью в физическом…

Sony и Warner судят Anthropic за пиратство: нейросети и авторское право на кону $1,5 млрд
Sony и Warner подали новый иск против Anthropic, обвинив лабораторию в нелегальном скачивании миллионов защищённых произведений для обучения модели Claude, и…

Судебные иски к Anthropic на миллиарды: Sony и Warner требуют по $150 000 за каждую песню
Музыкальные гиганты Sony Music и Warner Chappell подали коллективный иск к Anthropic, создателю ИИ-модели Claude, обвинив компанию и лично её сооснователей в…
Комментарии