Google DeepMind выпустила модель Gemini Omni 1.1 Flash через Gemini API в Google AI Studio. Главный фокус релиза сделан на детерминированном контроле монтажа и расширении сцен, а не на свободной генерации с нуля. Для руководителей инженерных и продакшн-команд это обновление устраняет главный барьер, мешавший коммерческому внедрению генеративного видео: полное отсутствие межкадровой согласованности и точного контроля во времени.
Модель обеспечивает расширенную непрерывность сцены, анализируя до 10 секунд контекста из предыдущего видеоряда — это серьезный шаг вперед по сравнению с односекундными окнами контекста в ранних сборках. Теперь разработчики могут последовательно наращивать хронометраж 10-секундными отрезками вплоть до 40 секунд, сохраняя сюжетную логику. Что критически важно: API позволяет фиксировать точные начальные и конечные ключевые кадры. Это дает стабильные и воспроизводимые траектории камеры — панорамы с быстрым панорамированием, слежение и зумы — без необходимости полагаться на слепую удачу в промптинге.
Чтобы сделать высоконагруженные пайплайны экономически целесообразными, Google добавила черновой режим в 360p. Он рендерит видео до 60% быстрее и требует лишь треть вычислительных затрат по сравнению со стандартным разрешением 720p. Инженерные команды могут дешево протестировать векторы движения, кадрирование и динамику сцены перед тем, как тратить дорогие вычислительные мощности на апскейлинг в высокое разрешение.
Генерация медиаконтента наконец-то переходит от стохастической рулетки с промптами к предсказуемому, программируемому рендерингу. Сочетая экономичный черновой режим, детерминированные ключевые кадры и сквозную связность сцен, Google дает B2B-платформам надежный инструмент для автоматизации видеопроизводства без слива бюджета на неудачные итерации.