Восемь малозаметных запусков с почти нулевой ранней реакцией: аналитика для агентного трафика, проверка надёжности агентов, наблюдение за внутренним состоянием, управление Blender, оплачиваемые сетевые прокси и разговорный учёт времени. Интерес здесь не в шуме, а в признаках будущей инфраструктуры.
Agent Arena предлагает проверять автономных агентов не на красивых демонстрациях, а в повторяемых испытаниях с наградами и репутацией. Идея сильная для команд, которым нужно сравнивать агентов, но её ценность зависит от качества заданий и защиты от накруток.
В свежем выпуске — десять историй о людях, которые не просто спросили AI в чате, а встроили его в работу: от самоуправляемых агентов в коде до голосового дневника, модели для пушту и первого подросткового питча местному бизнесу.
OpenAI вынесла ИИ-агентов из офисных сценариев в большую науку, а TechCrunch отдельно показывает обратную сторону той же волны: автоматические запросы уже нагружают госуслуги. Вместе это две стороны одной перемены — агенты становятся инфраструктурной силой, а не просто интерфейсом чата.
BetterClaw — сервис для личных и командных ИИ-агентов, которые работают по расписанию и подключаются к Gmail, Slack или Telegram. Главная идея проста: пользователь приносит собственный ключ к модели, а платформа даёт оболочку, интеграции и осторожный режим, где агент спрашивает перед важными действиями.
В русскоязычной подборке недели лидирует разбор OBSION о GPT-6 Astra и страхах вокруг сверхинтеллекта. Рядом — выступление Сэма Альтмана на G20, биологический взгляд Ирины Якутенко на конкуренцию с ИИ, разговор об образовании, практические ролики про ИИ-агентов, Yandex AI Studio и Hermes.
В свежей подборке видео недели: разговор Bloomberg с Кай-Фу Ли о соперничестве США и Китая, практические разборы GPT-6 Astra для монтажа и каналов без ведущего, короткое интервью BBC о рисках ИИ, лекция Кори Доктороу об инвестиционном пузыре и инженерные материалы от IBM и JetBrains.
DeepSeek объявила V4.1-Flash — самую компактную модель в семействе новой архитектуры V4.1. Компания делает акцент на встроенном понимании изображений, более быстрой работе, большей пропускной способности и постепенном масштабировании к старшим моделям.
На досках Arena модель GPT-image 2.5 Sunburst теперь стоит первой и в создании изображений по тексту, и в редактировании одного изображения. Это заметное движение относительно прежней картины, где лидером этих направлений была GPT-image 2 medium.