Google обновила Gemini 1.1 Flash: теперь модель поддерживает генерацию 40-секундных видео в 4K

27 августа 2026 года компания Google выпустила Gemini Omni 1.1 Flash — готовую к промышленному использованию ИИ-модель для работы с видео, способную создавать и расширять ролики до 40 секунд с финальным разрешением в 4K. Это стало одним из самых значительных обновлений в сфере инструментов для генерации видео под эгидой AInews.
Что именно Google представила в Gemini Omni 1.1 Flash?
Google выпустила Gemini Omni 1.1 Flash как свою новую мультимодальную модель генерации видео, ориентированную прежде всего на контроль, а не только на качество исходного изображения. Релиз добавляет функции расширения сцен, переходов на основе ключевых кадров, черновой визуализации в 360p, а также апскейлинга до 1080p и 4K для разработчиков, использующих Gemini API и продукты Google AI.
Модель позиционируется как основной движок Google для производства видео в стеке Gemini, заменяя более ранние версии, ограниченные как контекстом, так и разрешением. Согласно официальному блогу Google, Omni теперь поддерживает «видеопроизводство студийного качества» с помощью инструментов, предназначенных для редакторов и продуктовых команд, а не только для экспериментов.
- Дата запуска: 27 августа 2026 года в качестве производственного обновления линейки видеомоделей Gemini от Google.
- Название модели: Gemini Omni 1.1 Flash, доступна через Gemini API и сервисы Google AI.
- Основной фокус: расширение контроля над сценами, переходами и разрешением, а не просто повышение качества базовой генерации.
- Поддерживаемые выходные разрешения: 360p, 720p, 1080p и 4K (через апскейлинг).
Как работает новая система расширения сцен и почему важны 40 секунд?
Gemini Omni 1.1 Flash представляет систему расширения сцен с сохранением состояния, которая анализирует до 10 секунд предыдущего отснятого материала и продлевает клипы 10-секундными блоками с общим лимитом в 40 секунд. Этот сдвиг впервые делает возможным создание внутри модели последовательностей из нескольких кадров и непрерывных движений камеры.
Более ранние видеосистемы Google, такие как Veo, учитывали только последнюю секунду клипа перед созданием продолжения, что часто приводило к нарушению плавности движения или освещения. Omni 1.1 преодолевает этот «односекундный барьер». Она анализирует более длинный фрагмент существующего видео, поэтому продолжение может сохранять композицию, движение и стиль.
- Базовая длина клипа: 3–10 секунд за одну генерацию, согласно документации для разработчиков Google.
- Предыдущий контекст для расширения: до 10 секунд предшествующего материала вместо последней секунды.
- Шаг расширения: 10-секундные фрагменты, которые можно объединять в рамках сессии редактирования.
- Максимальная суммарная длительность: 40 секунд для одной сцены при объединении расширений.
В нескольких руководствах для разработчиков это описывается как «сессия редактирования с сохранением состояния», где каждый запрос на расширение ссылается на предыдущий ID взаимодействия. Это означает, что модель отслеживает непрерывность на протяжении нескольких шагов, а не воспринимает каждый запрос как новый.
Что на самом деле означает финальная обработка в 4K для создателей и разработчиков?
Gemini Omni 1.1 Flash не рендерит «родное» 4K с нуля, а использует апскейлинг для доведения сгенерированного материала до 1080p или 4K. Черновики могут быть быстро созданы в 360p для сокращения времени и затрат на итерации, а затем доработаны в высоком разрешении для финального релиза.
В блоге Google указано, что теперь Omni может генерировать «отполированные, высококачественные выходные файлы 1080p или 4K, готовые для профессионального производства», где 4K достигается за счет этапа апскейлинга. Changelog Gemini API подтверждает наличие нового параметра разрешения, охватывающего 360p, 720p, 1080p и 4K.
- Разрешение чернового режима: 360p, которое Google описывает как до 60 процентов быстрее, чем 720p, и примерно в три раза дешевле.
- Стандартная генерация: клипы 720p по обычной цене и скорости.
- Финальная обработка в высоком разрешении: апскейлинг до 1080p и 4K для финальной сдачи проекта.
- Ориентировочное ценообразование: согласно таблицам тарифов Gemini API, цена составляет $0.03 за секунду в 360p, $0.10 в 720p, $0.15 в 1080p и $0.30 за 4K.
Эти цифры основаны на сторонних обзорах документации Google и данных реселлеров, которые предупреждают, что бюджеты на производство в высоком разрешении следует считать предварительными, пока Google не обновит свою официальную страницу с ценами.
Какие новые элементы управления движением и стилем предлагает Omni 1.1 Flash?
Обновление добавляет возможность управления начальным и конечным ключевыми кадрами, поддержку коротких видеореференсов и более точные траектории движения. Эти функции позволяют авторам задавать движения камеры, сохранять дизайн персонажей и поддерживать стилистическую целостность в нескольких кадрах без ручной постобработки.
Ряд технических разборов описывает рабочий процесс, при котором пользователь предоставляет первый и последний кадры, а модель генерирует движение между этими двумя точками. Это открывает возможности для контролируемых облетов, зумов и циклов, которые ранее требовали ручной анимации или внешних инструментов.
- Переходы по первому и последнему кадрам: модель интерполирует движение между заданными кадрами, улучшая контроль над путями камеры.
- Видеореференсы: до трех секунд внешнего материала могут быть прикреплены как стилевой эталон для персонажей или движений.
- Качество движения: обзоры на специализированных ресурсах сообщают о «более чистых движениях» и меньшем количестве артефактов по сравнению с предыдущими сборками Omni.
- Мультимодальный ввод: Omni Flash работает с текстовыми подсказками в сочетании с изображениями или короткими видеоклипами внутри Gemini API.
Где доступна Gemini Omni 1.1 Flash и кто может использовать ее сегодня?
Gemini Omni 1.1 Flash уже работает в Gemini API и в продуктах Google AI, предназначенных для разработчиков и продвинутых пользователей. Она доступна для платных уровней Gemini и представлена в корпоративных платформах, используемых для создания агентов и автоматизации рабочих процессов.
Согласно Google и независимой документации, вызывать Omni 1.1 Flash можно из:
- Gemini API: доступна как gemini-omni-1.1-flash с конфигурационными опциями для работы с видео.
- Подписки Google AI Plus, Pro и Ultra: модель включена в Flow, структурированную среду ИИ от Google, и поддерживает расширение сцен в приложении Gemini.
- Платформы корпоративных агентов: документация Google Cloud включает Omni 1.1 Flash в список поддерживаемых моделей для агентских рабочих процессов с функциями работы с видео.
- Сторонние реселлеры и наборы инструментов: несколько руководств по интеграции включают Omni Flash в слои маршрутизации и панели управления для разработчиков.
Публикации от Google AI и независимых исследователей в социальных сетях подтверждают запуск, отмечая возможность расширения сцен до 40 секунд, поддержку 1080p и 4K, а также наличие чернового режима 360p, призванного сделать эксперименты более доступными.


