Google выпустила Gemini Omni 1.1 Flash для генерации видео
Google выпустила Gemini Omni 1.1 Flash — обновленную модель генерации видео, готовую для использования в продакшен-разработке. Модель доступна через API Gemini в Google AI Studio, а корпоративные клиенты могут работать с ней через Gemini Enterprise Agent Platform.
Главное нововведение — способность модели анализировать до 10 секунд предшествующего видео при продлении сцены, тогда как предыдущие версии опирались только на последний кадр. Это помогает сохранять персонажей, окружение и общее направление сцены более согласованными. Видео можно продлевать фрагментами по 10 секунд вплоть до общей длины в 40 секунд.
Разработчики также могут задать первый и последний кадры ролика — модель сама сгенерирует переход между ними: движение камеры вокруг объекта, плавное масштабирование или зацикленный клип. Для дополнительного визуального контекста в модель можно передать до трех секунд готового видео — например, чтобы она воспроизвела персонажа в новой сгенерированной сцене.
Для чернового тестирования идей предусмотрен режим генерации в разрешении 360p — он работает на 60% быстрее и втрое дешевле по сравнению со стандартным разрешением 720p. Финальный ролик можно получить в 1080p или масштабировать до 4K.
Omni 1.1 Flash также доступна пользователям с подпиской Google AI Plus, Pro и Ultra в приложении Google Flow — с сегодняшнего дня. Функция продления сцен появится и в основном приложении Gemini.
Источник: blog.google
