Главные новости по ИИ-моделям: Gemini снова поднимает вопрос автономного поведения в киберсреде, Vals строит независимые оценки моделей, а сообщество Hugging Face показывает практические сдвиги в малых моделях, квантовании, памяти агентов и самостоятельном запуске Qwen.
В новостях моделей: Google представила Gemini 3.8 Live и версию с расширенным рассуждением для голосовых агентов, Hugging Face опубликовал сравнительный рейтинг 425 моделей из OpenRouter, а Anthropic объединяет Claude, Cowork, Artifacts и Claude Design в одно рабочее окно.
Главная новость в моделях — Koa от Salesforce и Nvidia: крупный поставщик корпоративного ПО делает специализированную модель рассуждений для своих рабочих процессов. Рядом — GPT-Live-1 для голоса, ShadowPEFT для лёгкой донастройки и обсуждение отчёта OpenAI о злоупотреблениях.
Два сигнала с рынка моделей: OpenAI продвигает внутреннюю систему как инструмент для сложной математики, а Hugging Face показывает, как открытые погодные модели становятся ближе к практическому запуску.
Hugging Face и Earthmover показали, как запускать открытые модели прогноза погоды через готовые рабочие процессы. Это важный шаг от научных демонстраций к проверяемым и повторяемым прогнозам на общей инфраструктуре.
Photoroom выпустила PRX — открытую модель для генерации изображений по тексту, обученную с нуля и доступную в Diffusers под лицензией Apache 2.0. Для открытой экосистемы это заметно: модели изображений с разрешением на коммерческое использование выходят реже, чем текстовые.
Hugging Face за один день показал сразу несколько направлений открытого ИИ: прогнозирование временных рядов от IBM, датасет для голосовых агентов, единый API для зрительных моделей и сборку интерфейса генерации изображений на рабочих процессах Gradio.
OpenAI обновила ChatGPT Images и вывела две модели для API, IBM усилила специализированные прогнозные модели, а TinyDiT показал, что обучение генератора изображений с нуля становится доступнее небольшим командам.
Hugging Face на этой неделе принёс три разных сигнала о моделях: NeoMME сжимает хранение индекса страниц, Puffin-World пытается держать цельное трёхмерное состояние мира, а LFM2.5 показывает, что маленькие модели можно быстро подтягивать под строгий структурированный вывод.