Hacker News обсуждает журнал из 48 сбоев AI-агентов

Ветка на Hacker News ведёт к разработческому журналу «Six of 48», где автор собирает не один зрелищный провал, а многомесячную коллекцию неудач AI-агентов. Это гораздо полезнее обычной охоты за смешным скриншотом: агентные системы чаще ломаются не театрально, а буднично — делают неверное предположение, теряют состояние, плохо используют инструмент или восстанавливаются только в демонстрационном сценарии.

Смешная часть в том, что такие сбои редко выглядят как восстание машин. Скорее это стажёр, который уверенно перепутал дверь, потерял список дел и написал отчёт о том, как всё почти получилось. Но именно такие «почти» и накапливают реальную стоимость: лишние проверки, ручные откаты, недоверие к автоматизации и сложность объяснить, почему вчера работало, а сегодня нет.

Урок: надёжность начинается не с лозунга «добавим песочницу» и не с ожидания большого публичного инцидента. Командам нужно считать скучные ошибки, классифицировать причины и проверять пути восстановления так же внимательно, как они проверяют красивый успешный проход.