Alibaba Qwen выдала насыщенный цикл обновлений: один релиз нацелен на верхний сегмент возможностей, второй — на открытую и более дешёвую архитектуру для длинного контекста. Для рынка это не просто ещё две модели, а заявка на стек, где флагман, открытые веса и низкая цена для разработчиков двигаются вместе.

Qwen3.8-Max

Qwen официально выпустила Qwen3.8-Max и называет её самой сильной моделью в семействе. Это первый представитель класса Qwen-Max, для которого компания планирует открыть веса. Масштаб — 2,4 трлн параметров всего и 95 млрд активных параметров при обработке запроса.

Модель позиционируется для кодинга, офисной работы, исследований и долгих автономных задач. Доступ к API идёт через QwenCloud. Главное здесь — сочетание флагманского уровня и обещания открытых весов: если Alibaba действительно перенесёт часть возможностей верхнего класса в открытый доступ, конкуренция с закрытыми моделями станет заметно жёстче.

Qwen3.8-Flash-Next

Qwen3.8-Flash-Next вышла с открытыми весами как предварительный взгляд на архитектуру Qwen4. Модель мультимодальная и построена как разреженная смесь экспертов: основной размер — 125 млрд параметров, но на один токен активно около 6 млрд.

Контекст заявлен на 262 144 токена изначально и может расширяться до 1 млн токенов с помощью YaRN. Qwen также указывает цену производственного сервиса Qwen3.8-Flash: 0,15 доллара за миллион входных токенов и 0,47 доллара за миллион выходных токенов. Это особенно важно для агентных систем: длинный контекст и дешёвая работа модели напрямую влияют на стоимость многошаговых задач.

Вместе эти два релиза показывают стратегию Alibaba: флагман нужен для престижа и сложных задач, а Flash-ветка — для массового внедрения, где цена и длина контекста решают не меньше, чем тестовые баллы. Если Qwen удержит темп открытых весов, разработчики получат ещё один сильный вариант для локальных, облачных и гибридных ИИ-систем.