В этом выпуске две новости из мира моделей: Mistral обновила всю линейку сразу — от компактных моделей до новой флагманской Mistral Large 3, а Alibaba Cloud представила Qwen3.7-Plus как мультимодальную модель для агентных сценариев с работой по экрану и в графическом интерфейсе.
Google выпустила обзор майских AI-обновлений и свела их вокруг двух главных линий: Gemini 3.5 как семейства моделей для длинных многошаговых действий и Gemini Omni как модели, которая соединяет рассуждение с созданием видео из смешанных входных данных. По сути компания показывает, что делает ставку уже не на отдельные демонстрации, а на связанный слой моделей, поиска, устройств и пользовательских сценариев.
Anthropic представила обновление Claude Opus 4.6 и делает ставку на более сильную работу модели в длинных многошаговых сценариях. Главный смысл анонса не в косметической правке, а в том, что компания усиливает Claude как рабочий инструмент для сложного программирования, проверки кода и агентных задач с длинным горизонтом.
OpenAI анонсировала GPT-5.2-Codex и делает на неё ставку как на свою самую продвинутую модель для программирования. Главный акцент — длинные цепочки рассуждений, крупные изменения в коде и более сильная работа в задачах по кибербезопасности, что особенно важно для команд, строящих агентные инструменты разработки.
В свежем выпуске по моделям — два заметных релиза на Hugging Face: Microsoft показала FastContext-1.0-4B-SFT для поиска по коду внутри агентных сценариев, а независимый разработчик выпустил Inflect-Nano-v1 — сверхмалую локальную голосовую модель с 4,63 млн параметров.
xAI вывела Grok 4.3 в Amazon Bedrock и получила новый корпоративный канал дистрибуции: компания обещает окно контекста на 1 миллион токенов, настраиваемую глубину рассуждений и более простой путь для внедрения модели в крупных компаниях.
Google запустила семейство Gemini 3.5 и начала с Gemini 3.5 Flash — быстрой модели, которую компания продвигает как основу для инструментов, рабочих процессов и длинных многошаговых задач.
Moonshot AI разместила модель Kimi-K2.7-Code на Hugging Face под модифицированной лицензией MIT. Это заметный шаг для рынка открытых моделей для программирования: у релиза уже около 893 отметок, а запуск сразу сопровождается готовыми путями для развертывания через Transformers, vLLM, SGLang, Docker Model Runner и локальные квантованные сборки.
Google представила Gemini 3.1 Flash-Lite — новую модель для массовых нагрузок с заметно более низкой ценой и ускоренным откликом. Для разработчиков это важный сигнал: компания усиливает конкуренцию не только качеством, но и стоимостью работы моделей.