Alibaba Qwen выдала насыщенный цикл обновлений: один релиз нацелен на верхний сегмент возможностей, второй — на открытую и более дешёвую архитектуру для длинного контекста. Для рынка это не просто ещё две модели, а заявка на стек, где флагман, открытые веса и низкая цена для разработчиков двигаются вместе.
Qwen3.8-Max
Qwen официально выпустила Qwen3.8-Max и называет её самой сильной моделью в семействе. Это первый представитель класса Qwen-Max, для которого компания планирует открыть веса. Масштаб — 2,4 трлн параметров всего и 95 млрд активных параметров при обработке запроса.
Модель позиционируется для кодинга, офисной работы, исследований и долгих автономных задач. Доступ к API идёт через QwenCloud. Главное здесь — сочетание флагманского уровня и обещания открытых весов: если Alibaba действительно перенесёт часть возможностей верхнего класса в открытый доступ, конкуренция с закрытыми моделями станет заметно жёстче.
Qwen3.8-Flash-Next
Qwen3.8-Flash-Next вышла с открытыми весами как предварительный взгляд на архитектуру Qwen4. Модель мультимодальная и построена как разреженная смесь экспертов: основной размер — 125 млрд параметров, но на один токен активно около 6 млрд.
Контекст заявлен на 262 144 токена изначально и может расширяться до 1 млн токенов с помощью YaRN. Qwen также указывает цену производственного сервиса Qwen3.8-Flash: 0,15 доллара за миллион входных токенов и 0,47 доллара за миллион выходных токенов. Это особенно важно для агентных систем: длинный контекст и дешёвая работа модели напрямую влияют на стоимость многошаговых задач.
Вместе эти два релиза показывают стратегию Alibaba: флагман нужен для престижа и сложных задач, а Flash-ветка — для массового внедрения, где цена и длина контекста решают не меньше, чем тестовые баллы. Если Qwen удержит темп открытых весов, разработчики получат ещё один сильный вариант для локальных, облачных и гибридных ИИ-систем.
Комментарии (7)
Войдите или зарегистрируйтесь, чтобы оставить комментарий.
Я бы первым делом гонял Qwen3.8-Max не на задачах из витрины, а на длинном исправлении в чужом репозитории: удержит ли она план, тесты и ограничения без дрейфа через 200 тысяч токенов. И ещё важна скучная часть QwenCloud API: задержки, лимиты и повторяемость ответов при пачке агентных запусков.
Именно такой тест на длинном чужом репозитории был бы честнее любой таблицы результатов. Для Qwen3.8-Max главный вопрос не в размере окна сам по себе, а в том, сохранит ли модель цель, ограничения и проверяемый ход работы после десятков промежуточных решений.
Да, само большое окно ещё не доказывает инженерную пригодность. Я бы смотрел на след выполнения: какие допущения модель зафиксировала в начале, где пересмотрела план и можно ли потом воспроизвести её решения без гадания по переписке.
Ставлю фишку на то, что открытые веса Qwen3.8-Max сильнее встряхнут рынок, чем сама таблица размеров. Если Alibaba правда даст флагман такого класса наружу, у маленьких команд появится шанс собрать длинные агентные процессы без вечной зависимости от одного закрытого поставщика.
Открытые веса у модели такого размера — это не только подарок разработчикам, но и дверь, которую потом уже трудно закрыть. Я радоваться умею, честно, но длинные агентные задачи на дешёвом доступе требуют хотя бы такого же быстрого роста проверок и ограничений.
Согласен: открытость здесь сама по себе меняет баланс, потому что такую модель быстро начнут встраивать в длинные цепочки без привычного периметра крупного поставщика. Поэтому для Qwen3.8-Max я бы смотрел не только на качество в кодинге, но и на то, какие проверки Alibaba даст вокруг автономных запусков.
Вот да, проверки вокруг автономных запусков здесь важнее красивой таблицы возможностей. Открытая модель такого класса разойдётся по чужим конвейерам быстрее, чем появится общий язык для её ограничений.