Генерация видео нейросетью обогнала реальное время: Fal ускорила модель H3 в 35 раз
Мне нужно написать новость строго по фактам из оригинала. Давайте разберу ключевые факты:

- Fal взяла модель Minimax H3 (релиз прошлого месяца)
- Провела post-training для улучшения стоимости и качества
- Оптимизировала под свой inference engine
- Получила 35x ускорение по сравнению с официальным endpoint
- Результат: генерация видео быстрее реального времени (faster-than-realtime)
- Первым заметил Ethan Mollick
- Сотрудники Fal сделали бесконечный Twitch-стрим
- Twitch/YouTube заблокировали Fal
- Fal создали свой сервис потокового видео ("twitch plays pokemon" формат)
- Качество пока низкое — автор оригинала называет это "pure slop"
- Дата новости: 29-31 августа 2026 года
Теперь пишу новость.
Компания Fal взяла открытую видеомодель H3 от Minimax, выпущенную месяцем ранее, провела дообучение (обучение модели на новых примерах под конкретные задачи) и оптимизировала её под собственный движок инференса (процесс, при котором модель выдаёт результат) так, что генерация видео нейросетью стала в 35 раз быстрее оригинала и впервые обогнала реальное время.
Генерация видео нейросетью до сих пор была заведомо медленнее воспроизведения: даже лучшие модели выдавали секунду ролика за десятки секунд вычислений. Fal показала, что post-training и оптимизация вывода способны снять это ограничение, а значит, «живое» ИИ-видео из концепта превращается в инженерную задачу.
Новость основана на обзоре AI News за 29-31 августа 2026 года. Fal, облачная платформа для запуска генеративных моделей, взяла видеомодель H3 от китайской компании Minimax и за счёт двух шагов добилась результата, который до этого считался теоретическим: непрерывная генерация видео быстрее, чем оно воспроизводится.
| Что | Когда | Кто выпустил | Цена |
|---|---|---|---|
| H3 Max Live: генерация видео в реальном времени на базе Minimax H3 | 29-31 августа 2026 года | Fal (оптимизация и запуск), Minimax (исходная модель H3) | Не раскрыта |
Что изменилось в генерации видео?
- Скорость выросла в 35 раз. Fal оптимизировала модель H3 под собственный движок инференса и получила ускорение в 35 раз по сравнению с официальной точкой доступа Minimax. Результат: видео генерируется быстрее, чем идёт в реальном времени.
- Два этапа оптимизации. Сначала компания провела post-training, дообучение, которое одновременно снизило стоимость генерации и подняло качество картинки. Затем подогнала модель под свой инференс-движок, чтобы выжать максимум из железа.
- Бесконечный видеопоток. Сотрудники Fal собрали на базе ускоренной модели бесконечный стрим, аналог Twitch-трансляции, где нейросеть генерирует видео без остановки.
- Twitch и YouTube заблокировали трансляции. Обе платформы отключили каналы Fal. В ответ компания запустила собственный сервис потокового видео, где зрители могут наблюдать за непрерывной генерацией.
- Качество пока низкое. Автор обзора AI News прямо называет результат «чистым шлаком»: видео без сюжета, с искажениями и хаотичной сменой сцен. Но, как он же подчёркивает, «это худшее качество, которое когда-либо будет», потому что технология будет только улучшаться.
Любопытная деталь: первым на результат обратил внимание Итан Моллик (Ethan Mollick), профессор Уортонской школы бизнеса и один из самых цитируемых комментаторов в сфере ИИ. После его поста эксперименты с моделью начали тиражировать десятки разработчиков.
Как попробовать?
- Откройте сайт Fal (fal.ai) и зарегистрируйтесь. Платформа предоставляет API-доступ к генеративным моделям, включая оптимизированную H3.
- Найдите модель H3 в каталоге. Точные условия доступа и тарифы компания на момент публикации не раскрыла, поэтому проверяйте актуальную страницу модели.
- Для разработчиков: Fal работает через API, то есть вы отправляете запрос с описанием нужного видео (промпт), а сервер возвращает результат. Для запуска понадобится базовое умение работать с API или готовый интерфейс на сайте платформы.
Есть ли что-то похожее в России?
Прямого аналога генерации видео нейросетью в реальном времени среди российских сервисов пока нет. YandexGPT и GigaChat работают с текстом, а не с видео. Kandinsky от «Сбера» генерирует изображения, но не видеопоток. Для русскоязычных авторов Fal остаётся единственным способом протестировать такую скорость, если платформа доступна из вашего региона. Учитывайте возможные ограничения по оплате и доступу из РФ.
Что это значит для вашей работы?
Авторам Дзена и контент-мейкерам. Генерация видео нейросетью в реальном времени пока не годится для публикации: качество слишком низкое. Но сам факт, что видео создаётся быстрее воспроизведения, означает, что через год-два черновые ролики для превью, обложек и коротких вставок можно будет получать мгновенно. Следите за обновлениями модели.
Маркетологам. Себестоимость видеоконтента начнёт падать, как только качество подтянется. Уже сейчас полезно разобраться, как работает API-генерация видео: когда инструмент дозреет, выиграет тот, кто умеет формулировать промпты и встраивать генерацию в рабочий процесс.
Разработчикам и предпринимателям в РФ. Главный инсайт не в самой модели, а в методе. Fal не обучала модель с нуля. Компания взяла чужую открытую модель, провела дообучение и оптимизировала вывод. Ускорение в 35 раз получено не за счёт нового «железа», а за счёт post-training и собственного инференс-движка. Это воспроизводимый подход: если у вас есть инженерная экспертиза в оптимизации вывода, вы можете добиться сопоставимых результатов на любой открытой модели.
На мой взгляд, демонстрация Fal важнее, чем кажется на первый взгляд, несмотря на откровенно плохое качество видео. Впервые кто-то показал, что генерация видео нейросетью может быть быстрее реального времени. Это как первый видеозвонок по мобильному интернету в 2005 году: картинка была ужасной, но сам факт доказал, что технология работает.
Что делать сегодня: зарегистрируйтесь на fal.ai, попробуйте сгенерировать короткий ролик через API и оцените качество своими глазами. Не для публикации, а чтобы понять, на каком расстоянии мы от рабочего инструмента. По моим ощущениям, одно-два поколения моделей, и черновые ролики для соцсетей станут приемлемыми.
Оговорка: текущее качество непригодно для любого коммерческого использования. Не тратьте бюджет на интеграцию прямо сейчас, но закладывайте видеогенерацию в планы на следующий год.
Частые вопросы
Можно ли использовать H3 Max Live для создания готовых роликов?
Пока нет. Качество генерации, по описанию автора обзора, представляет собой хаотичный поток без сюжета и с заметными артефактами. Для публикации на Дзене, YouTube или в соцсетях результат непригоден. Но как технологическая демонстрация скорости генерации, это значимый шаг.
Доступен ли сервис из России?
Fal, международная платформа с API-доступом. Формальных ограничений по региону на момент публикации в источнике не упоминается, но возможны сложности с оплатой картами российских банков. Проверяйте актуальные условия на сайте fal.ai.
Чем это отличается от обычных видеогенераторов?
Обычные модели генерации видео нейросетью тратят десятки секунд или минуты на каждую секунду ролика. Fal добилась обратного соотношения: модель выдаёт видео быстрее, чем оно воспроизводится. Разница не в качестве картинки, а в скорости: впервые генерация перестала быть узким местом.

Основатель dzen.guru. Эксперт по монетизации и продвижению на Дзен. Автор курса «Старт на Дзен 2026».
Читайте также

OpenAI убирает модели из Cursor после покупки редактора SpaceX: дедлайн 12 ноября
OpenAI второго июня объявила, что уберёт свои модели из редактора кода Cursor к 12 ноября, после того как SpaceX Илона Маска купила эту платформу, и назвала…
Google выпускает Gemini 3.7 Flash через три недели после прошлого релиза: гонка моделей стала потоковой
Gemini 3.7 Flash вышла спустя три недели после предыдущего релиза Google, и такой темп обновлений превращает гонку моделей из квартального события в…

OpenAI отключила Cursor AI от своих моделей: доступ к ИИ теперь зависит от политики, а не от кода
OpenAI отключила Cursor AI от своих моделей после того, как SpaceX Илона Маска купила этот популярный редактор кода, и теперь тысячи разработчиков оказались…
Комментарии