Gemini Omni 1.1 Flash: продакшен-генерация видео с управлением сценами и 4K
Google выпустила Gemini Omni 1.1 Flash. Это обновление видеогенератора Omni, заточенное под разработчиков: больше контроля над сценой, быстрее итерации, готовый к продакшену результат. Модель вышла 27 августа 2026 года и доступна через Google AI Studio и Gemini Enterprise Agent Platform.
Gemini Omni 1.1 Flash уже доступна всем пользователям, включая пользователей из России, на vega.chat и через api.vega.chat. Можно работать с моделью в веб-интерфейсе или подключить через API, совместимый с OpenRouter.
Что изменилось по сравнению с первой версией
Первая Gemini Omni принесла в генеративное видео рассуждение о реальном мире. Версия 1.1 делает следующий шаг: даёт разработчику инструменты, чтобы управлять сценой, а не просто получать ролик по одному промпту. Появились продление сцен, интерполяция по ключевым кадрам, черновой режим 360p, апскейл до 4K и видео-референсы в мультимодальном вводе.
Продление сцен до 40 секунд
Теперь можно взять существующий ролик и продолжить генерацию с того момента, где она остановилась.
Модель анализирует до 10 секунд предыдущего контекста. У предыдущей версии контекст ограничивался последней секундой. Это значит, что продолжение лучше держит визуальную консистентность и логику повествования: персонажи, освещение и композиция не «уплывают» на стыке.
Продлевать можно порциями по 10 секунд, до 40 секунд суммарной длины. Это подходит для длинных историй и для разветвления сюжета в новые направления.
Пример вызова через Gemini API:
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-omni-1.1-flash",
previous_interaction_id=previous_video_interaction.id,
input=[
{"type": "text", "text": "Continue the scene."}
],
response_format={
"resolution": "360p",
},
)
Интерполяция по первому и последнему кадру
Можно задать стартовый и конечный кадр, и модель сгенерирует непрерывное видео между ними. Это удобно для сложных камер-орбит, зум-переходов и бесшовных зацикленных клипов.
Например, можно описать крупный план барабанщика в бежевом костюме, а затем через whip-pan перейти к саксофонисту и балерине под мягким фиолетовым светом. Один непрерывный кадр, без склеек.
Черновые ролики в 360p
Для быстрого прототипирования появился режим 360p. Он генерирует превью до 60% быстрее стандартного 720p и стоит втрое дешевле. Подходит для сторибордов, проверки идей и сравнения вариантов до того, как тратить ресурсы на финальный рендер.
Апскейл до 4K
Финальный ролик можно вывести в 1080p или 4K. Это делает результат пригодным для профессионального продакшена, а не только для черновиков и соцсетей.
Видео-референсы в мультимодальном вводе
В промпт можно передать до трёх секунд видео как опорный материал. Модель учитывает визуальный контекст и удерживает консистентность персонажей на основе видео-референсов.
Например, можно загрузить три ролика с танцорами и заменить их на своих персонажей: собака танцует классику из одного клипа, осьминог — хип-хоп из другого, медведь — брейк из третьего. Результат — один непрерывный кадр без склеек.
Что можно построить на этих возможностях
Несколько примеров того, как разработчики применяют новые инструменты в своих продуктах:
- Приложение, где пользователь загружает первый и последний кадр, а Omni генерирует переход между ними по пресету или текстовому промпту. Полный контекст модели позволяет получить камер-мувы, которые читаются как настоящие.
- Виртуальный тур по недвижимости: камера проходит по комнатам, арки, наезжает и отъезжает, показывает дом в выгодном свете и в нужное время суток, не добавляя мебель и детали, которых нет в реальности.
- «Draft Room» для креаторов: генерация трёх-четырёх черновых вариантов в 360p, где меняется одна переменная за раз, и сравнение их бок о бок. Дешёвая и структурированная разведка перед финальным рендером.
Как попробовать Gemini Omni 1.1 Flash
Модель доступна двумя способами:
- vega.chat — веб-интерфейс, где можно выбрать модель, отправить промпт и сравнить результат с другими видеогенераторами. Подходит для тестов, подбора модели под задачу и работы с текстом, изображениями и видео.
- api.vega.chat — API, совместимый с OpenRouter. Подходит для интеграции модели в приложения, скрипты и продакшен-конвейеры. Поддерживаются стандартные эндпоинты: chat completions, стриминг, tool calling и другие.
Чтобы начать через API, замените base URL на https://api.vega.chat и используйте ваш ключ vega.chat. Формат запросов совпадает с OpenRouter, поэтому существующий код менять почти не придётся.
Модель доступна всем пользователям, без географических ограничений. Пользователям из России не нужны VPN или зарубежные аккаунты: vega.chat и api.vega.chat работают напрямую.