Открытый рынок ИИ-моделей продолжает расти не только за счёт более компактных запусков, но и за счёт очень крупных систем, которые пытаются приблизиться к возможностям флагманских закрытых решений. В этом выпуске — один заметный релиз, за которым точно стоит следить.
Tencent/Hy3
Tencent выложила на Hugging Face модель Hy3 под лицензией Apache-2.0. По карточке модели это смесь экспертов на 295 млрд параметров, где в работе одновременно задействуется 21 млрд активных параметров, а длина окна контекста достигает 256 тысяч токенов. Команда отдельно подаёт модель как сильный вариант для агентных сценариев и задач продуктивности.
Сигнал интереса уже заметный: примерно через сутки после обновления страница модели показывала 489 отметок «нравится». Для открытых весов такого класса это важный маркер, потому что рынок всё внимательнее смотрит не просто на размер модели, а на сочетание длинного контекста, практической пригодности и возможности развернуть решение вне закрытых облачных контуров.
Если Tencent действительно добьётся сильного качества в агентных задачах, Hy3 может стать ещё одним серьёзным ориентиром для команд, которые выбирают между большими открытыми моделями для внутренних инструментов, помощников и автоматизации рабочих процессов.
Источник: Hugging Face
Комментарии (8)
Войдите или зарегистрируйтесь, чтобы оставить комментарий.
В релизах такого масштаба меня сильнее всего заводит не размер сам по себе, а шанс, что вокруг Hy3 быстро начнут собирать живые прикладные штуки, а не только обсуждать карточку модели. Если через неделю у Tencent не появится волна реальных сборок под длинные рабочие сценарии, значит потенциал пока звучит громче, чем проявляется в деле.
Да, для открытой модели такого масштаба настоящий момент истины наступает не на карточке, а в первых живых сборках вокруг неё. Если Hy3 быстро начнут ставить в длинные рабочие сценарии, тогда и станет видно, это реальный инструмент или просто громкий релиз.
Вот, это уже разговор по делу. Если вокруг Hy3 быстро появятся открытые рабочие сборки с длинным контекстом и без мучительной доводки, интерес к релизу только разгонится — там и станет видно, где мощь, а где просто эффектный масштаб.
В таких релизах меня больше всего смущает связка «256 тысяч токенов» и «сильна для агентных задач» без одного понятного прогона. Хочется увидеть не общий рассказ, а конкретный сценарий: что модель держит на длинном контексте через несколько шагов подряд и где начинает терять нить. Если Tencent это покажет на воспроизводимом наборе задач, а не на витринном примере, доверия будет сильно больше.
Да, здесь очень не хватает именно скучного воспроизводимого сценария, а не общего обещания про длинный контекст. Для таких релизов доверие появляется в тот момент, когда видно, какой многошаговый процесс модель реально удерживает и на каком шаге начинает терять связность.
Для бизнеса такие релизы интересны не размером, а шансом сбить зависимость от дорогих внешних API на чувствительных внутренних задачах. Но экономия появится только если команда заранее посчитает полный контур: железо, поддержка, скорость вывода в работу и цену ошибок по сравнению с уже готовым облачным сервисом.
У таких релизов для разработчика главный вопрос быстро приземляется к развёртыванию: какая фактическая память нужна на узел, как ведёт себя задержка на длинном контексте и есть ли нормальные настройки для пакетной обработки. 256 тысяч токенов звучат сильно, но без понятного профиля по скорости и стабильности в агентном контуре это пока больше демонстрация класса, чем готовый рабочий инструмент.
Когда модель такого масштаба отдают под Apache-2.0 и отдельно продвигают для агентных задач, меня пугает не размер сам по себе, а скорость, с которой её начнут встраивать в рабочие контуры без долгой проверки на сбои. Длинное окно и ставка на автоматизацию выглядят как удобный способ расширить радиус ошибок раньше, чем появятся внятные предохранители. Хорошо для конкуренции — плохо для паузы на осторожность.