Hugging Face вынесла сразу два сильных сигнала для мира открытого AI: локальный запуск крупных моделей на ноутбуках улучшается быстрее, чем обновляется само железо, а рост экосистемы всё заметнее держится на огромных открытых релизах и работе сообщества по квантованию. Вместе это показывает, что центр тяжести смещается от одной только мощности к качеству архитектур и инструментов доставки.
Сообщество Hugging Face разбирает Kimi K3 от Moonshot AI как одну из самых заметных открытых моделей момента: речь о системе с открытыми весами, колоссальным масштабом и MXFP4-квантованием, которая снова подогревает гонку вокруг мощных открытых моделей.
Hugging Face подробно представила семейство GPT OSS от OpenAI: две модели с открытыми весами, смесью экспертов и упором на рассуждение, агентные сценарии и локальный запуск. Старшая версия помещается на один H100, младшая рассчитана примерно на 16 ГБ памяти, а лицензия Apache 2.0 делает релиз особенно заметным для сообщества открытого ИИ.
Сегодняшняя подборка не про очередные громкие релизы, а про более важный сдвиг: ИИ всё заметнее меняет реальные рабочие процессы, рынок труда, образование и саму логику исследований. От атаки на Hugging Face до эксперимента о сокращении образовательного разрыва — собрал пять материалов, которые помогают понять, как именно это происходит.
Главный AI-видеосюжет недели — подробный доклад Black Hat о конфликте OpenAI и Hugging Face. В подборку также вошли ролики о рисках автономных агентов, новом взгляде Geoffrey Hinton на 2030 год, возможностях OpenAI Astra и о том, как Gemini Omni упрощает создание видео со звуком из одного запроса.
OpenAI заморозила работу над моделью Astra из-за опасных кибервозможностей, Китай сокращает разрыв с США в ИИ, взлом Hugging Face усилил тревогу вокруг новой волны атак, а OpenAI купила NextSlide, чтобы встроить создание презентаций глубже в ChatGPT.
Hugging Face собрала сразу три практичные новости для открытого ИИ: Optimum Intel 2.1 расширил поддержку новых мультимодальных моделей, LM Studio упростила запуск GGUF и MLX прямо из Hub, а Baseten подключилась к Inference Providers. Вместе это делает путь от открытых весов до реального использования заметно короче.
Liquid AI представила LFM2.5-2.6B — компактную модель с открытыми весами для многошаговых агентных сценариев прямо на устройстве. По данным анонса на Hugging Face, ей хватает менее 2,5 ГБ памяти, при этом она поддерживает вызов инструментов и показывает скорость до 220 токенов в секунду на Apple M5 Max.
Google представила Nano Banana 2 для более управляемой и быстрой генерации изображений, Agnes AI пытается зайти на рынок с бесплатным мультимодальным API и длинным контекстом, а на Hugging Face показали, насколько дёшево теперь можно запускать эксперименты с малыми открытыми моделями.