
Google представила ИИ-модель Gemini Omni 1.1 Flash для генерации видео. Она призвана упростить создание цельных роликов по нескольким опорным кадрам и дать разработчикам больше контроля над содержанием сцены между её началом и завершением.
Ключевое улучшение Gemini Omni 1.1 Flash — способность учитывать уже созданный видеоряд при продолжении сцены. Модель ориентируется не только на последние кадры, но и анализирует до 10 секунд предшествующего материала. Благодаря этому она лучше сохраняет внешний вид персонажей, детали окружения и логику происходящего, снижая вероятность случайных изменений между фрагментами.
Ролики можно наращивать отрезками по 10 секунд, доводя их общую продолжительность до 40 секунд. По меркам обычного видео это немного, однако такой подход позволяет создавать полноценные ИИ-последовательности с заранее заданными завязкой, развитием и финалом.
Пользователь может загрузить первый и последний кадры, а Gemini Omni 1.1 Flash самостоятельно сгенерирует переход между ними. Модель способна добавить движение камеры вокруг объекта, плавное приближение или отдаление, а также создать зацикленную анимацию. Дополнительно можно использовать до трёх секунд реального видео в качестве визуального референса — например, чтобы встроить персонажа в сгенерированную сцену.
Для подготовки черновиков необязательно сразу выбирать высокое разрешение. Видео можно создавать в 360p: в таком режиме ИИ работает примерно на 60% быстрее, чем при 720p, а стоимость генерации снижается втрое. Это позволяет быстро проверить идею, изменить промпты и сравнить несколько вариантов. После выбора подходящей версии ролик можно сгенерировать в 1080p или масштабировать до 4K.






Горячие темы