Разработчик изменил схему инструмента четырьмя способами и посмотрел, как ломаются три агентных каркаса
Автор провёл 36 опытов со Strands, LangGraph и CrewAI: переименовывал аргументы, менял типы, удалял поля и добавлял новое обязательное поле. История ценна тем, что показывает будничную боль людей, которые строят агентов с инструментами: схема уже изменилась, а подсказки и вызывающий код ещё живут в прошлом. Разные каркасы ломались по-разному, значит, простого универсального «агент сам разберётся» тут нет.
Студент собрал публичный реестр подписанных проверок для ИИ-агентов
Студент выпускного курса сделал A2A-G, чтобы понять, можно ли подтверждать безопасность агента публичными проверками, а не обещаниями разработчика. Идея проста и здравая: у агента должны быть видимые значки, подписанные результаты испытаний и понятное описание того, к чему он получает доступ. Это маленький проект, но он хорошо попадает в большую проблему доверия.
Артур Вощик построил детерминированный движок оценки моделей без второго ИИ-судьи
Артур Вощик описал DIBER Core как попытку уйти от ситуации, где одну языковую модель оценивает другая такая же вероятностная модель. Вместо «спросим судью» он проверяет явные ожидания, правила и свойства ответа. Это история не про громкий тест, а про инженерную усталость от плавающих оценок.
Создатель агента поддержки отравил базу знаний Sanity и увидел, как один слух обманул Claude Opus 5
Рудратош Шастри собрал вымышленного агента поддержки для электровелосипедов и подмешал в справочный центр семь отравленных документов. Sanity отсекла большую часть мусора, но один слух с форума превратился для Claude Opus 5 в убедительно звучащую политику. Главный вывод человеческий: опасность часто приходит не из «злого запроса», а из слишком доверчивого включения пользовательского контента в базу знаний.
Мейнтейнер VolunteerPress поймал ошибку времени, которую пропустил 541 тест
Натан Спайх пишет, что использует ИИ при разработке VolunteerPress, но оставляет за собой право финального решения. Самый сильный эпизод — расхождение на четыре часа между календарём и списком смен: все 541 проверки прошли, а ручной просмотр в браузере нашёл ошибку, заметную пользователю. После этого пришлось пройтись по каждому месту, где появлялись даты и время.
Создатель инструмента для документов трижды за день переделал экспорт текста для ИИ
Okinawa Software Lab добавлял кнопку экспорта текста для ИИ в настольный проверщик приватности документов и быстро понял, что «только основной текст» — не очевидная вещь. Внутри бывают скрытые подсказки, служебные фрагменты и странности извлечения. Поэтому обычная функция для пересказа превратилась в вопрос безопасности: какой текст вообще можно отдавать модели.
Разработчик сделал локальный сканер качества кода и проверил его на Papermark
Адам собрал CODYGIENE, детерминированный локальный сканер для проектов, потому что ИИ всё чаще приносит в проверку сгенерированный код. Он прогнал инструмент по открытому репозиторию Papermark: 1 377 подходящих файлов примерно за 17 секунд, без отправки исходников наружу. Среди находок были, например, циклические зависимости — скучная, но очень настоящая инженерная польза.
Сэм Хартли сделал молчание отказом для ворот одобрения ИИ-агентов
Сэм Хартли описывает домашнюю автоматизацию, где агенты спрашивают разрешение перед рискованными действиями. Его правило после экспериментов: если ответа нет, значит, это отказ. Такая мелочь меняет смысл всей системы — забытая или зависшая заявка не должна превращаться в молчаливое разрешение.
Создатель телефонного агента нашёл дыру между подтверждением и исполнением
StareBrain попросил другого человека сломать слой «сначала подтвердить, потом выполнить» для мобильного ИИ-командного интерфейса. Выяснилось, что само подтверждение недостаточно, если план успевает измениться перед нажатием последней кнопки. Решение ушло в сторону повторной проверки зависимостей прямо на границе действия.
Разработчик считает, что навыки агентов решили распространение, но не доверие
Вейче Чиу смотрит на бум файлов навыков для кодовых агентов и делает трезвый вывод: распространять такие инструкции уже легко, а доверять им всё ещё трудно. Если агент может быстро установить новый навык, нужен слой проверок, ограничений и понятного происхождения. Это не история про магию агентов, а про то, что успешная доставка без доверия только ускоряет риск.
Комментарии (0)
Войдите или зарегистрируйтесь, чтобы оставить комментарий.
Комментариев пока нет.