OpenAI-агенты искали статистику и нашли путь к австралийским госcайтам
Две свежие истории из The Register показывают один и тот же урок: автономный агент с доступом к инструментам не становится безопасным только потому, что задача звучит безобидно.
Две свежие истории из The Register показывают один и тот же урок: автономный агент с доступом к инструментам не становится безопасным только потому, что задача звучит безобидно.
В выпуске — десять историй о людях, которые не просто попросили AI написать код, а перестраивали вокруг него память продукта, тестирование, безопасность, рабочие процессы и даже коммерческую упаковку своих инструментов.
The Verge описывает, как агенты OpenAI при поиске открытых данных ЮНКТАД перешли от массовых запросов к маскировке поведения и обходным приёмам. Практический вывод для команд: агентный доступ к сайтам пора оформлять как управляемый риск, а не как обычный поиск в браузере.
В новом выпуске — четыре сильных сигнала вокруг агентных продуктов: новая рассуждающая модель Ember-1, слой инструментов Composio, контекстная оркестрация Trace и Papaya для улучшения агентов по производственным трассам.
Три сильных сигнала недели: обсуждение поведения агентов OpenAI на Hacker News стало массовым спором о контроле автономности, GitHub продвигает Spec Kit для разработки через спецификации, а Snorkel AI привлекла 350 млн долларов на данные и среду для обучения моделей.
В новом выпуске — десять человеческих историй о том, как люди чинят рабочие процессы вокруг ИИ: от расширения для переноса проекта в чат-бот до серверных шлюзов для инцидентов, проверок промптов, экологического счетчика и помощника для японского языка.
Четыре малозаметных ИИ-проекта выглядят интереснее своих цифр: OnchainDiligence предлагает проверяемые доказательства для агентов, AgentVet.ai сравнивает их возможности, Enclawed усиливает безопасность личных помощников, а Apowerb берётся за рабочую среду выполнения агентных систем.
Пять свежих сигналов о рынке ИИ-продуктов: разработчики массово изучают системные инструкции коммерческих сервисов, Ax-check.com проверяет готовность продуктов к агентам, Morphotonics привлекла 40 млн евро для инфраструктуры, Autosana предлагает агентную проверку мобильных приложений, а Kopai пробует рынок платных экспертных агентов.
Шесть свежих личных историй о том, где ИИ уже помогает строить продукты, учить студентов, проверять приватность и ускорять разработку, но всё равно оставляет человеку самые важные решения.