ИИ
Google представила Gemini Omni 1.1 Flash — новую версию генеративной модели ИИ, способную удлинять существующие видео до 40 секунд, генерировать промежуточные кадры между начальным и конечным фреймами, использовать короткие видеоролики в качестве референсов и создавать видео в разрешении до 4K.

Компания Google анонсировала выпуск Gemini Omni 1.1 Flash — обновлённой версии генеративной ИИ-модели, расширяющей функциональные возможности создания и редактирования видео. Среди ключевых нововведений — удлинение существующих видеосцен, генерация промежуточных кадров между заданными начальным и конечным фреймами, использование коротких видеороликов в качестве визуальных референсов, а также поддержка вывода видео в разрешении до 4K.
Модель способна анализировать до 10 секунд предшествующего видеоряда при удлинении существующего ролика — в отличие от предыдущих версий, опиравшихся лишь на последнюю секунду. Разработчики могут добавлять удлинения поэтапно, с шагом в 10 секунд, при этом совокупная продолжительность дополнительного фрагмента достигает 40 секунд. Это позволяет контент-мейкерам завершать сцены с сохранением визуальной и нарративной целостности оригинала.
Одна из центральных возможностей Gemini Omni 1.1 Flash — задание начального и конечного кадров с последующей автоматической генерацией промежуточных кадров для их связки. Инструмент поддерживает сложные движения камеры, включая вращение вокруг объектов и зумирование, а также плавные переходы, обеспечивающие непрерывность или цикличность видеосегмента. Такой подход даёт творческим специалистам возможность точно определять желаемый результат, а не полагаться исключительно на текстовые описания для полной генерации видео «с нуля».
Модель поддерживает использование видеороликов продолжительностью до трёх секунд в качестве визуальных референсов при создании новых видео. Эта функция помогает сохранять конкретные детали — например, внешность персонажей или визуальную среду. Google продемонстрировала возможность применения нескольких референсных роликов в рамках одного непрерывного видео для воспроизведения различных движений.
Для ускорения первоначального тестирования идей Google внедрила режим генерации видео в разрешении 360p. По заявлению компании, создание черновых версий в таком качестве происходит на 60 % быстрее, чем в 720p, а стоимость производства составляет примерно одну треть от затрат на ролик в 720p. Этот режим ориентирован на этапы быстрого прототипирования и разработки сторибордов перед финальной генерацией в высоком разрешении — 1080p или 4K.
Доступ к Gemini Omni 1.1 Flash осуществляется через Gemini API в Google AI Studio для разработчиков и через Agent Platform API для корпоративных клиентов. Google опубликовала техническую документацию, руководства по использованию, готовые примеры и рекомендации по формулировке команд для генерации видео. Модель доступна глобально подписчикам тарифных планов AI Plus, AI Pro и AI Ultra через платформу Google Flow и мобильное приложение Gemini. Функция удлинения сцен также активна в приложении Gemini для указанных подписчиков.
Google сообщила, что Gemini Omni 1.1 Flash уже интегрируется в процессы видеопроизводства ряда компаний и платформ, включая Adobe, Figma Weave, GMI Cloud и Runway. Выпуск модели отражает стратегический сдвиг Google в сторону разработки ИИ-инструментов, выходящих за рамки генерации видео «с нуля»: новые решения способны понимать существующие кадры, дополнять их, управлять переходами и камерными движениями, а также обеспечивать визуальную и нарративную согласованность сцены.



