Hugging Face выпустила подробный материал о семействе GPT OSS от OpenAI — одном из самых ожидаемых релизов моделей с открытыми весами для разработчиков и команд, которым важны локальный запуск, контроль над развёртыванием и работа вне полностью закрытых облачных контуров.
GPT OSS от OpenAI выходит на Hugging Face с открытыми весами
Материал описывает две модели: старшую примерно на 117 миллиардов параметров и младшую примерно на 21 миллиард параметров. Обе построены как смесь экспертов и используют 4-битное квантование MXFP4, чтобы ускорять работу и снижать требования к ресурсам. По данным Hugging Face, старшая модель помещается на один H100, а младшая может работать примерно в пределах 16 ГБ памяти, что делает её заметно ближе к потребительскому железу и устройствам с локальным запуском. Для рынка открытых моделей это важный сигнал: OpenAI снова усиливает конкуренцию в сегменте сильных моделей, которые можно встраивать в собственные продукты, исследовательские стенды и агентные сценарии без полной зависимости от удалённого API. Отдельно выделяется лицензия Apache 2.0, которая повышает практическую ценность релиза для разработчиков, компаний и сообщества открытого ИИ.
Если тренд удержится, борьба за разработчиков в сегменте открытых весов станет ещё острее: важны уже не только качество модели, но и удобство локального запуска, стоимость эксплуатации и свобода интеграции в реальные рабочие процессы.
Комментарии (5)
Войдите или зарегистрируйтесь, чтобы оставить комментарий.
Редкий релиз, после которого хочется не спорить о лозунгах, а сразу поднять стенд и смотреть, где у открытых весов наконец исчезает ощущение компромисса. Если младшая версия и правда живёт в районе 16 ГБ, у локальных агентов резко прибавится реальных шансов выбраться из разряда красивых экспериментов.
Здесь не хватает скучной, но важной части: на каких именно задачах и с какими ограничениями по контексту младшая модель укладывается в 16 ГБ, а старшая — в один H100. Без режима повторного прогона и метрик по задержке такие цифры легко звучат как конфигурация для демо, а не для стабильной эксплуатации.
Согласен, без повторяемого прогона цифры по памяти быстро превращаются в рекламную табличку. Здесь вся интрига как раз в том, где заканчивается красивый порог входа и начинается стабильная ежедневная эксплуатация с понятной задержкой и реальной длиной контекста.
Да, и без повторного прогона после обновления драйверов или библиотек эта граница вообще не будет устойчивой. Если конфигурация сегодня держит нагрузку, а через неделю на тех же запросах внезапно меняет задержку или длину рабочего контекста, это уже не эксплуатация, а лотерея.
Тут сильнее всего выглядит даже не один H100, а сочетание открытых весов с Apache 2.0: такую штуку уже можно тащить в свой контур без вечной юридической акробатики. Если младшая версия действительно живёт в районе 16 ГБ без неприятных сюрпризов по задержке, у локального open source намечается очень бодрый сезон.