Qwen 3.8 Omni Flash — омнимодальная модель Alibaba уже в vega.chat

18 сентября Alibaba выпустила Qwen3.8-Omni-Flash — омнимодальную модель, которая принимает на вход текст, изображения, аудио и видео. Отвечает она только текстом: генерации речи, как у прошлогодней Qwen3-Omni-Flash, здесь нет. Вместо этого Alibaba сделала ставку на агентские сценарии — модель должна не просто понимать контент, а сама планировать шаги и вызывать инструменты.
Модель уже работает на vega.chat: она заменила Qwen 3.8 Flash и теперь стоит за веб-поиском. Через api.vega.chat она доступна по идентификатору alibaba/qwen3.8-omni-flash.
Параметры
| Параметр | Значение |
|---|---|
| Вход | текст, изображения, аудио, видео |
| Выход | только текст |
| Контекст | 1 млн токенов |
| Макс. выход | 131K токенов |
| Thinking | включён по умолчанию, глубина регулируется |
Архитектура называется Qwen3.8-Flash-Next, работает через DashScope и OpenAI-совместимый API.
Пространственное аудио
По заявлению Alibaba, это первая мультимодальная модель, которая определяет направление и расстояние до источников звука: она совмещает пространственное аудио с визуальной информацией. Поддерживаются двух- и четырёхканальные записи, в Chat Completions режим включается флагом use_multichannel.
Агентские сценарии
Модель ориентирована на задачи, где нужен готовый результат, а не описание: монтаж видео и музыкальных клипов, комментарии к фильмам, PDF-конспекты обучающих роликов, перевод коротких сериалов с сохранением тембра голоса. Ещё она умеет осваивать новые действия по видеодемонстрациям.
Вместе с моделью вышли открытые плагины Qwen-MM-Plugins для агентских фреймворков и Qwen-Live-Harness — среда с открытым кодом для интерактивных приложений на realtime-API с WebSocket и WebRTC. Поддерживаются OpenAI Codex, Anthropic Claude Code, Qwen Code и Google Gemini CLI.
Отдельно в семействе есть Qwen3.8-LiveTranslate-Flash-Realtime — модель для перевода аудио и видео: понимает 60 языков, говорит на 29.
Бенчмарки
На WildClawBench-MM, который проверяет мультимодальную работу с инструментами, модель набирает 71.0 против 58.9 у Gemini 3.8 Flash и 34.5 у прошлого поколения Qwen3.5-Omni-Plus. На OmniVideoBench: 63.4 в обычном режиме и 67.8 в режиме Qwen Code против 65.2 и 70.1 у Gemini 3.8 Flash.
В режиме Qwen Code расход токенов при этом снизился на 45.7% — со 145 736 до 79 117. В среднем по 29–30 бенчмаркам Alibaba заявляет рост больше 25% относительно Qwen3.5-Omni-Plus. Важно понимать: это цифры самой Alibaba, независимых проверок пока нет.
Цена
- Вход: $0.15 за 1M токенов
- Выход: $0.47 за 1M токенов
- Вход с implicit cache: $0.016 за 1M токенов
Главное практическое изменение — цена аудио. Аудиовход подешевел более чем на 98% относительно прошлого поколения, комбинированный аудио-видео вход — больше чем на 93%. Лимиты API: 2M TPM и 30K RPM.
Доступность
Открытых весов нет, модель работает только через API. Доступна в Qwen Chat в вебе и мобильных приложениях, для разработчиков — через DashScope с OpenAI-совместимыми клиентами. В Alibaba Cloud BaiLian работает в регионах Пекин, Сингапур, Гонконг, Токио, Франкфурт и Вирджиния. Поддерживаются батч-обработка, тонкая настройка и prefix completion.
Как попробовать
- vega.chat — модель стоит за веб-поиском: выберите режим Web и задайте вопрос.
- api.vega.chat — API, совместимый с OpenRouter, идентификатор
alibaba/qwen3.8-omni-flash. Замените base URL наhttps://api.vega.chatи используйте ваш ключ vega.chat — существующий код менять почти не придётся.