Google представляет Gemini Omni 1.1 Flash, способный создавать 4K AI-видео продолжительностью до 40 секунд

Google Gemini Omni ии-видео обновление генерация видео 4k neowin.net

Google обновила модель генерации видео Gemini Omni до версии 1.1 Flash. Узнайте о расширении сцен до 40 секунд, контроле первого и последнего кадра, апскейлинге до 4K и интеграции с Adobe Firefly. Новые инструменты для разработчиков и создателей контента.

Компания Google представила Gemini Omni 1.1 Flash — новейшую версию своей модели генерации видео. Обновление приносит более длинные расширения сцен, управление первым и последним кадром, более дешевые предпросмотры в низком разрешении и апскейлинг до 4K для разработчиков, работающих с видео, созданным ИИ.

Всего несколько месяцев назад Google впервые представила модель Gemini Omni Flash на мероприятии I/O 2026. Тогда Google объяснила, чем Omni отличается от других типичных моделей преобразования текста в видео: она может работать со смесью текста, изображений, аудио и видео. Она также поддерживает диалоговое редактирование, позволяя пользователям продолжать запрашивать изменения, не запуская весь процесс генерации заново.

С новой версией Omni 1.1 Google пытается сделать этот процесс более практичным. Пожалуй, самое большое изменение в новой модели — это возможность расширения существующей сцены. Теперь модель может анализировать до 10 секунд предыдущего видео перед генерацией того, что будет дальше, тогда как предыдущая версия использовала для контекста только последнюю секунду. Google утверждает, что дополнительный контекст поможет более последовательно сохранять персонажей, движение и общее направление сцены.

Видео можно расширять фрагментами по 10 секунд до общей продолжительности в 40 секунд. Это все еще мало по сравнению с традиционно смонтированным видео, но дает создателям значительно больше возможностей для построения последовательности, а не сшивания набора несвязанных ИИ-клипов.

Google также добавила интерполяцию первого и последнего кадров. Вы можете передать Omni 1.1 изображение, показывающее, как должен начинаться кадр, и другое, показывающее, где он должен закончиться, а затем модель сгенерирует видео между ними. Google предполагает, что это можно использовать для таких вещей, как орбитальные движения камеры, наезды, переходы и зацикленные клипы.

Когда клип готов, Omni 1.1 может выводить его в разрешении 1080p или 4K. Однако здесь есть важное примечание. Согласно документации Gemini API от Google, как 1080p, так и 4K являются апскейлингом, а не генерируются в этих разрешениях изначально. По умолчанию остается 720p, также доступно 360p.

Gemini Omni 1.1 Flash доступен через Gemini API в Google AI Studio и на платформе Google Gemini Enterprise Agent. За пределами разработческой стороны Google сообщает, что Omni 1.1 глобально доступен в Flow для подписчиков Google AI Plus, Pro и Ultra, а расширение сцен также доступно этим подписчикам в приложении Gemini.

Google представляет Gemini Omni 1.1 Flash, способный создавать 4K AI-видео продолжительностью до 40 секунд

Модель также начинает появляться в большем количестве сторонних продуктов и продуктов Google. Adobe интегрировала Gemini Omni Flash в Firefly, а Google недавно внедрил модель в Vids.

Заинтересованные могут прочитать полный релиз здесь, включая информацию о том, как использовать Gemini API для создания видео с помощью новой модели.

Всегда имейте в виду, что редакции могут придерживаться предвзятых взглядов в освещении новостей.

В тренде:


Похожие новости: