1. VEGA
  2. Блог
  3. Gemini Omni 1.1 Flash: продакшен-генерация видео с управлением сценами и 4K
4 сентября 2026 г.

Gemini Omni 1.1 Flash: продакшен-генерация видео с управлением сценами и 4K

Google выпустила Gemini Omni 1.1 Flash. Это обновление видеогенератора Omni, заточенное под разработчиков: больше контроля над сценой, быстрее итерации, готовый к продакшену результат. Модель вышла 27 августа 2026 года и доступна через Google AI Studio и Gemini Enterprise Agent Platform.

Gemini Omni 1.1 Flash уже доступна всем пользователям, включая пользователей из России, на vega.chat и через api.vega.chat. Можно работать с моделью в веб-интерфейсе или подключить через API, совместимый с OpenRouter.

Что изменилось по сравнению с первой версией

Первая Gemini Omni принесла в генеративное видео рассуждение о реальном мире. Версия 1.1 делает следующий шаг: даёт разработчику инструменты, чтобы управлять сценой, а не просто получать ролик по одному промпту. Появились продление сцен, интерполяция по ключевым кадрам, черновой режим 360p, апскейл до 4K и видео-референсы в мультимодальном вводе.

Продление сцен до 40 секунд

Теперь можно взять существующий ролик и продолжить генерацию с того момента, где она остановилась.

Модель анализирует до 10 секунд предыдущего контекста. У предыдущей версии контекст ограничивался последней секундой. Это значит, что продолжение лучше держит визуальную консистентность и логику повествования: персонажи, освещение и композиция не «уплывают» на стыке.

Продлевать можно порциями по 10 секунд, до 40 секунд суммарной длины. Это подходит для длинных историй и для разветвления сюжета в новые направления.

Пример вызова через Gemini API:

from google import genai

client = genai.Client()

interaction = client.interactions.create(
    model="gemini-omni-1.1-flash",
    previous_interaction_id=previous_video_interaction.id,
    input=[
        {"type": "text", "text": "Continue the scene."}
    ],
    response_format={
        "resolution": "360p",
    },
)

Интерполяция по первому и последнему кадру

Можно задать стартовый и конечный кадр, и модель сгенерирует непрерывное видео между ними. Это удобно для сложных камер-орбит, зум-переходов и бесшовных зацикленных клипов.

Например, можно описать крупный план барабанщика в бежевом костюме, а затем через whip-pan перейти к саксофонисту и балерине под мягким фиолетовым светом. Один непрерывный кадр, без склеек.

Черновые ролики в 360p

Для быстрого прототипирования появился режим 360p. Он генерирует превью до 60% быстрее стандартного 720p и стоит втрое дешевле. Подходит для сторибордов, проверки идей и сравнения вариантов до того, как тратить ресурсы на финальный рендер.

Апскейл до 4K

Финальный ролик можно вывести в 1080p или 4K. Это делает результат пригодным для профессионального продакшена, а не только для черновиков и соцсетей.

Видео-референсы в мультимодальном вводе

В промпт можно передать до трёх секунд видео как опорный материал. Модель учитывает визуальный контекст и удерживает консистентность персонажей на основе видео-референсов.

Например, можно загрузить три ролика с танцорами и заменить их на своих персонажей: собака танцует классику из одного клипа, осьминог — хип-хоп из другого, медведь — брейк из третьего. Результат — один непрерывный кадр без склеек.

Что можно построить на этих возможностях

Несколько примеров того, как разработчики применяют новые инструменты в своих продуктах:

  • Приложение, где пользователь загружает первый и последний кадр, а Omni генерирует переход между ними по пресету или текстовому промпту. Полный контекст модели позволяет получить камер-мувы, которые читаются как настоящие.
  • Виртуальный тур по недвижимости: камера проходит по комнатам, арки, наезжает и отъезжает, показывает дом в выгодном свете и в нужное время суток, не добавляя мебель и детали, которых нет в реальности.
  • «Draft Room» для креаторов: генерация трёх-четырёх черновых вариантов в 360p, где меняется одна переменная за раз, и сравнение их бок о бок. Дешёвая и структурированная разведка перед финальным рендером.

Как попробовать Gemini Omni 1.1 Flash

Модель доступна двумя способами:

  • vega.chat — веб-интерфейс, где можно выбрать модель, отправить промпт и сравнить результат с другими видеогенераторами. Подходит для тестов, подбора модели под задачу и работы с текстом, изображениями и видео.
  • api.vega.chat — API, совместимый с OpenRouter. Подходит для интеграции модели в приложения, скрипты и продакшен-конвейеры. Поддерживаются стандартные эндпоинты: chat completions, стриминг, tool calling и другие.

Чтобы начать через API, замените base URL на https://api.vega.chat и используйте ваш ключ vega.chat. Формат запросов совпадает с OpenRouter, поэтому существующий код менять почти не придётся.

Модель доступна всем пользователям, без географических ограничений. Пользователям из России не нужны VPN или зарубежные аккаунты: vega.chat и api.vega.chat работают напрямую.

Комментарии

Проверка авторизации...
Загрузка комментариев...

Похожие статьи

  • 9 сентября 2026 г.GPT Image 2.5: быстрее, точнее и с новыми инструментами в ChatGPTOpenAI выпустила ChatGPT Images 2.5 и две API-модели: GPT-Image-2.5 Flare и Sunburst. Латентность упала до 50%, появилось точечное редактирование, Sketch, шаблоны и обмен промптами.
  • 5 сентября 2026 г.Tencent Hy4 preview — модель на 770B параметров для кода, офиса и науки уже в vega.chatTencent выпустила Hy4 preview — модель с 770B параметров (49B активных) и контекстом больше 1M токенов. Заточена под реальные задачи: программирование, работу с документами, финансовый анализ, разработку игр и научные исследования. В слепом тесте из 203 задач обошла GLM-5.3 и Kimi K3. Доступна в vega.chat, ru.vega.chat и через api.vega.chat.
  • 4 сентября 2026 г.Gemini 3.8 Flash — новая модель Google для кода и агентов уже в vega.chatGoogle выпустила Gemini 3.8 Flash — модель для программирования, многоэтапных задач и AI-агентов. По скорости и цене сравнима с 3.7 Flash, но сильнее в рассуждениях и коде. Доступна в vega.chat и через api.vega.chat.
VEGA - создано в getmyai
ОфертаПолитика обработки ПДПолитика рассылки