Содержание
Пять реальных сценариев для видео в Gemini Omni
Google показала пять проектов, созданных с помощью Gemini Omni Flash — мультимодальной модели для генерации и редактирования видео в диалоге. Она принимает текст, изображения, видео и аудио как референсы, а правки можно задавать обычными словами.
Ракурсы и окружение меняются без пересъёмки
В одном из примеров автор превратил исходную сцену с человеком в городе примерно в 20 вариантов: камера приближалась и отдалялась, переходила с уровня улицы на верхний и нижний ракурс, а фон менялся между тротуарами, перекрёстками и городскими улицами. При этом модель сохраняла общую логику сцены.
Другой создатель редактировал уличный ролик голосом: переключил день на ночь, добавил облака и дождь, сделал листья осенними, а затем покрыл землю снегом. Для креаторов это полезный сценарий препродакшена — одну съёмку можно быстро превратить в серию визуальных вариантов для рекламы, сториборда или презентации.
Эскизы становятся анимацией, а видео меняет стиль
В Google Flow модель умеет использовать нарисованные поверх кадра подсказки как траектории и формы движения. В демонстрациях лимон превратился в подводную лодку, чашка эспрессо — в воздушный шар, ножницы — в акулу, а спички и перцы стали основой для коротких фантазийных сцен.
Omni также переносит один ролик между визуальными стилями, сохраняя движение персонажа: живое видео может плавно перейти в аниме, пластилиновую анимацию и другие стили. Отдельный пример показал прикладную визуализацию — от проекта благоустройства парка до анимированного объяснения бизнес-дашборда и игрового списка задач.
Где попробовать Gemini Omni
Модель доступна в приложении Gemini, Google Flow, Google AI Studio, Gemini API и корпоративной платформе Gemini Enterprise Agent Platform. Главная практическая ценность обновления — возможность не просто сгенерировать клип, а итеративно править композицию, действие и эстетику без возврата к полноценной съёмке или ручному монтажу на каждом шаге.