Главная новость выпуска — Alibaba Cloud показала Qwen-RobotNav: навигационную модель на базе Qwen3-VL, рассчитанную сразу на несколько типов задач, от поиска объектов до автономного вождения. Рядом — релиз Mistral OCR 4, который усиливает ставку Mistral на прикладные модели для извлечения структуры из документов и развёртывания внутри собственной инфраструктуры компании.
TechCrunch пишет, что OpenAI пока показывает GPT-5.6 только ограниченному кругу партнёров и согласовывает доступ почти вручную. Это важный сигнал: выпуск передовых моделей всё больше превращается из обычного релиза в контролируемый процесс с участием государства.
WeiboAI представила VibeThinker-3B — компактную модель на 3 млрд параметров, ориентированную на математику, программирование и другие задачи из естественных наук. По описанию на странице модели, она показывает результаты на проверяемых задачах рассуждения на уровне заметно более крупных систем и набрала 96,1% принятия с первой попытки в недавних соревнованиях LeetCode.
xAI представила новую флагманскую голосовую модель Grok Voice Think Fast 1.0, рассчитанную на быстрые многошаговые диалоги в поддержке, продажах и корпоративных сценариях. Это важно, потому что гонка между ведущими лабораториями всё заметнее смещается из текстовых помощников в сторону голосовых агентов реального времени.
General Intuition подтвердила привлечение 320 млн долларов при оценке 2,3 млрд долларов и делает ставку не на очередной чат или генератор картинок, а на базовую модель, которая учит AI-агентов двигаться в пространстве и времени через среды, похожие на видеоигры. Для рынка это важный сигнал: борьба за следующий слой AI всё заметнее уходит в мир пространственного понимания и обучения действию, а не только текста, кода и изображений.
xAI сообщила, что ускоренная версия Grok Imagine Video 1.5 теперь генерирует шестисекундное видео в 720p примерно за 25 секунд вместо более чем 40 секунд у предыдущей модели. Для рынка моделей это важный сигнал: в генерации видео скорость все чаще становится таким же конкурентным преимуществом, как и качество результата.
Google подаёт Gemini 3 Deep Think как режим рассуждения для науки, исследований и инженерной работы. Это ещё один шаг в гонке за модели, которые соревнуются уже не только удобством для массового пользователя, а качеством на сложных профессиональных задачах.
OpenAI добавила новый режим проверенного доступа для GPT-5.5 в задачах киберзащиты и одновременно представила GPT-5.4 mini и nano как более лёгкие и быстрые варианты для массовых рабочих нагрузок. В сумме это важный сдвиг сразу по двум направлениям: более жёсткое управление доступом к сильным возможностям и более широкий выбор моделей для экономной промышленной эксплуатации.
Apple подробно показала Foundation Models framework и тем самым обозначила более амбициозную роль в гонке ИИ: компания хочет быть не только витриной приложений, но и полноценной платформой моделей для разработчиков.