В сегодняшней мировой AI-повестке — новый скачок оценки у Lovable, более естественный голосовой режим у ChatGPT, публичная проверка маркировки SynthID на политической дезинформации и свежий рывок Grok 4.5 в ценовой гонке больших моделей.
В мире ИИ-моделей и агентных платформ день получился не про одну новую большую модель, а про резкое расширение способов внедрения уже существующих систем. Google усиливает Gemini сразу по двум направлениям — персонализация изображений и более зрелая агентная платформа, Anthropic выводит Claude Cowork за пределы рабочего стола, Microsoft чаще подставляет свои модели в Office, а Meta проверяет, насколько далеко можно зайти с генерацией картинок на базе публичных фото из Instagram.
Google расширила Managed Agents в Gemini API: теперь платформа поддерживает фоновое выполнение долгих задач, прямое подключение к удалённым MCP-серверам, собственные вызовы функций и обновление учётных данных между сессиями. Для разработчиков это важный шаг от коротких демонстраций к более живучим агентным сервисам, которые можно держать в рабочем контуре.
В новом выпуске по ИИ-моделям всего два пункта, но оба хорошо показывают, куда движется рынок. Google усиливает ставку на одну центральную модель и сразу разворачивает её по всей своей экосистеме, а OpenAI, наоборот, ещё сильнее дробит линейку под конкретные рабочие сценарии — в данном случае под программирование в реальном времени.
Google открыла бета-доступ к Gemini Spark на macOS для подписчиков Google AI Ultra в США. Это важный шаг не просто для очередного режима чата: Gemini всё явнее превращают в помощника, который живёт на компьютере постоянно, следит за задачами в реальном времени и работает сразу через несколько приложений.
Сразу два заметных проекта для создания ИИ-агентов набрали хороший ход в открытой разработке: Facebook продвигает Astryx как настраиваемую дизайн-систему для продуктов с агентами, а Google развивает agents-cli как набор инструментов для создания, проверки и запуска таких систем в облаке.
В свежей подборке по открытому ИИ — терминальный мультиплексор herdr, утилита Google для создания и развёртывания агентов и шлюз OmniRoute, который сводит сотни поставщиков моделей к одной точке входа.
Google представила два новых медиамодуля Gemini: Nano Banana 2 Lite для быстрого и недорогого создания изображений и Gemini Omni Flash для генерации видео и разговорного редактирования. Это расширяет набор производственных инструментов для команд, которые строят мультимедийные приложения через Gemini API и Google AI Studio.
The Verge сообщает, что Google начал ограничивать, сколько вычислительных мощностей Gemini может использовать Meta. Эта история важна не только как эпизод соперничества крупных компаний, но и как сигнал более общей проблемы: гонка вокруг AI всё сильнее упирается не в идеи и бюджеты, а в дефицит инфраструктуры.