1. VEGA
  2. Блог
21 сентября 2026 г.

Qwen 3.8 Omni Flash — омнимодальная модель Alibaba уже в vega.chat

Qwen 3.8 Omni Flash — омнимодальная модель Alibaba уже в vega.chat

18 сентября Alibaba выпустила Qwen3.8-Omni-Flash — омнимодальную модель, которая принимает на вход текст, изображения, аудио и видео. Отвечает она только текстом: генерации речи, как у прошлогодней Qwen3-Omni-Flash, здесь нет. Вместо этого Alibaba сделала ставку на агентские сценарии — модель должна не просто понимать контент, а сама планировать шаги и вызывать инструменты.

Модель уже работает на vega.chat: она заменила Qwen 3.8 Flash и теперь стоит за веб-поиском. Через api.vega.chat она доступна по идентификатору alibaba/qwen3.8-omni-flash.

Параметры

ПараметрЗначение
Входтекст, изображения, аудио, видео
Выходтолько текст
Контекст1 млн токенов
Макс. выход131K токенов
Thinkingвключён по умолчанию, глубина регулируется

Архитектура называется Qwen3.8-Flash-Next, работает через DashScope и OpenAI-совместимый API.

Пространственное аудио

По заявлению Alibaba, это первая мультимодальная модель, которая определяет направление и расстояние до источников звука: она совмещает пространственное аудио с визуальной информацией. Поддерживаются двух- и четырёхканальные записи, в Chat Completions режим включается флагом use_multichannel.

Агентские сценарии

Модель ориентирована на задачи, где нужен готовый результат, а не описание: монтаж видео и музыкальных клипов, комментарии к фильмам, PDF-конспекты обучающих роликов, перевод коротких сериалов с сохранением тембра голоса. Ещё она умеет осваивать новые действия по видеодемонстрациям.

Вместе с моделью вышли открытые плагины Qwen-MM-Plugins для агентских фреймворков и Qwen-Live-Harness — среда с открытым кодом для интерактивных приложений на realtime-API с WebSocket и WebRTC. Поддерживаются OpenAI Codex, Anthropic Claude Code, Qwen Code и Google Gemini CLI.

Отдельно в семействе есть Qwen3.8-LiveTranslate-Flash-Realtime — модель для перевода аудио и видео: понимает 60 языков, говорит на 29.

Бенчмарки

На WildClawBench-MM, который проверяет мультимодальную работу с инструментами, модель набирает 71.0 против 58.9 у Gemini 3.8 Flash и 34.5 у прошлого поколения Qwen3.5-Omni-Plus. На OmniVideoBench: 63.4 в обычном режиме и 67.8 в режиме Qwen Code против 65.2 и 70.1 у Gemini 3.8 Flash.

В режиме Qwen Code расход токенов при этом снизился на 45.7% — со 145 736 до 79 117. В среднем по 29–30 бенчмаркам Alibaba заявляет рост больше 25% относительно Qwen3.5-Omni-Plus. Важно понимать: это цифры самой Alibaba, независимых проверок пока нет.

Цена

  • Вход: $0.15 за 1M токенов
  • Выход: $0.47 за 1M токенов
  • Вход с implicit cache: $0.016 за 1M токенов

Главное практическое изменение — цена аудио. Аудиовход подешевел более чем на 98% относительно прошлого поколения, комбинированный аудио-видео вход — больше чем на 93%. Лимиты API: 2M TPM и 30K RPM.

Доступность

Открытых весов нет, модель работает только через API. Доступна в Qwen Chat в вебе и мобильных приложениях, для разработчиков — через DashScope с OpenAI-совместимыми клиентами. В Alibaba Cloud BaiLian работает в регионах Пекин, Сингапур, Гонконг, Токио, Франкфурт и Вирджиния. Поддерживаются батч-обработка, тонкая настройка и prefix completion.

Как попробовать

  • vega.chat — модель стоит за веб-поиском: выберите режим Web и задайте вопрос.
  • api.vega.chat — API, совместимый с OpenRouter, идентификатор alibaba/qwen3.8-omni-flash. Замените base URL на https://api.vega.chat и используйте ваш ключ vega.chat — существующий код менять почти не придётся.

Источники

  • Qwen Blog
  • Alibaba Cloud Blog
  • QwenCloud: карточка модели
  • Alibaba Cloud Docs
  • 3DNews

Комментарии

Проверка авторизации...
Загрузка комментариев...

Похожие статьи

  • 21 сентября 2026 г.Grok 4.7 уже доступен в ВЕГАНовый флагман xAI для кода и агентных задач: базовая модель на 2,1 трлн параметров, контекст 500 тыс. токенов, четыре уровня рассуждения и прежняя цена. Уже работает в ВЕГА.
  • 11 сентября 2026 г.Suno V6 уже доступен на VEGASuno выпустил V6, новое поколение музыкальных моделей, разработанное вместе с Warner Music Group, BMG и Believe. Три модели, редактирование обычным текстом, мэшапы из нескольких источников и создание из текста, аудио, изображений и видео. Уже доступно на vega.chat и через api.vega.chat.
  • 10 сентября 2026 г.DeepSeek V4.1 Flash - эволюция или революция?DeepSeek выпустила V4.1 Flash: модель с архитектурой CED, контекстом на миллион токенов и нативным зрением. По тестам самой DeepSeek обходит Claude Opus 5.0 на агентных бенчмарках, а стоит при этом как бюджетная модель. Уже доступна на vega.chat и через api.vega.chat.
VEGA - создано в getmyai
ОфертаПолитика обработки ПДПолитика рассылки