Qwen выпустила Qwen3.8-Omni-Flash — свежую омнимодальную модель, рассчитанную на работу со звуком, видео и агентными сценариями. В описании релиза компания делает акцент на видеомонтаже, создании музыкальных клипов, комментариях к видео, аудиовизуальном пересказе и разговорах в реальном времени.

Главная техническая заявка — контекст до миллиона токенов и заметный прирост качества по сравнению с Qwen3.5-Omni-Plus: Qwen говорит о среднем улучшении более чем на 25% по 29 оценкам. Для разработчиков важна и экономическая часть: модель обещает существенно более низкую стоимость обработки аудио и аудиовизуальных входных данных в расчёте на час.

Это выглядит как полноценный флагманский запуск, а не небольшое обновление документации. Если заявления подтвердятся в реальных задачах, Qwen3.8-Omni-Flash может стать сильной основой для продуктов, где ИИ должен не просто отвечать текстом, а понимать длинные записи, видеопотоки и живой голосовой контекст.