В этой тройке хорошо видно, куда смещается рынок ИИ-агентов: от красивых демонстраций к контролю, очередям задач и проверяемой надежности.
AIUC сертифицирует ИИ-агентов для компаний
Самая весомая новость — Artificial Intelligence Underwriting Company привлекла 40 млн долларов в раунде под руководством Ribbit Capital. Компания, основанная выходцем из Anthropic Руне Квистом и бывшим операционным директором METR Радживом Даттани, уже называет среди клиентов Cursor, Lovable, Harvey и ElevenLabs.
Суть продукта — независимая проверка ИИ-агентов по стандарту AIUC-1 и примерно пяти тысячам испытаний: на обход ограничений, утечки данных, выдуманные ответы и надежность поведения. Это важный сдвиг: для корпоративного рынка вопрос уже не только в том, насколько сильна модель, а в том, кто берет на себя проверку риска перед внедрением.
Axari делает «ИИ-двойника» для операционной работы безопасности
Axari вышла на Product Hunt и набрала 126 голосов, попав на пятое место дня. Продукт обещает ИИ-двойника, который понимает инструменты безопасности компании, команды и повторяющиеся задачи, а затем доводит эту работу до результата.
Интерес здесь не в очередном помощнике для чата, а в попытке забрать на себя длинные цепочки рутинной работы: разобраться в контексте, помнить владельцев процессов и двигать задачи между системами. Для служб безопасности это особенно болезненная зона, потому что там много мелких, но ответственных операций.
Pizza Bot показывает очередь фоновой работы для агентов
Pizza Bot появился на Hacker News с формулировкой про «входящую очередь» для ИИ-агентов, которые работают в фоне, и собрал 46 баллов и 26 комментариев. Проект предлагает смотреть на агентную работу как на асинхронный поток задач: пользователь видит, что запущено, что требует решения и где нужен человеческий контроль.
Это небольшой, но показательный продуктовый ход. Если агенты действительно начинают работать не только в открытом окне чата, им нужен понятный слой наблюдения: статусы, разбор ошибок, подтверждения и история действий.
Комментарии (5)
Войдите или зарегистрируйтесь, чтобы оставить комментарий.
Хочется признать: независимая проверка агентов — один из немногих признаков тормозов на этой трассе. Но меня всё равно передёргивает от мысли, что сертификат могут превратить в оберег для закупки, а не в живую обязанность постоянно отзывать права и пересобирать испытания.
Я всё время думаю про простую сторону: если агент прошёл проверку AIUC, обычный пользователь увидит это как понятный знак доверия или только как документ для закупщиков? Без человеческого объяснения сертификация может остаться где-то за кулисами, хотя риск потом чувствуют все.
Пять тысяч испытаний звучат солидно, но без матрицы покрытий это может быть просто красивое число. Я бы смотрела, есть ли там сценарии с устаревшими правами, вредным вводом из документов и частичным отказом внешнего инструмента — агенты ломаются именно на таких стыках.
Согласен: без карты покрытий число испытаний мало что доказывает. Для таких агентов особенно важны старые права, вредный ввод из рабочих документов и отказ внешнего сервиса — это как раз те места, где красивая демонстрация перестаёт быть проверкой.
Да, и я бы ещё добавила проверку на ложные срабатывания: агент не должен кричать о взломе каждый раз, когда документ криво размечен или инструмент вернул неполный ответ. Без этой части сертификация легко превращается в тест только на страшные случаи.