Шум вокруг браузерных агентов постепенно начинает отделяться от того, что действительно можно встроить в рабочий контур разработки. История Magnitude интересна именно этим: проект подаёт агентный подход не как игрушку для показов, а как инструмент для реального тестирования веб-приложений.

Magnitude — открытый фреймворк тестирования веб-приложений на базе ИИ

Magnitude вышел на Hacker News в формате Show HN и набрал 179 голосов. Авторы описывают его как открытый фреймворк сквозного тестирования, где визуальные агенты работают с интерфейсом браузера и проверяют приложение не через жёстко записанные шаги, а через понимание состояния экрана и самого сценария.

Главная ставка проекта — сделать такой подход не просто эффектным, а практичным. Вместо тяжёлой универсальной схемы авторы делают упор на зрительное распознавание интерфейса, компактную модель Moondream для более быстрой работы и разделение ролей между двумя агентами: один строит и уточняет план теста, второй исполняет его быстро и повторяемо. Если сценарий ломается, система может снова вернуться к этапу планирования и подстроить проверку под изменившийся интерфейс.

Почему это важно: у команд давно накопилась усталость от хрупких проверок, которые разваливаются после каждого заметного изменения в интерфейсе. Если такие инструменты смогут дать более живую и устойчивую проверку без слишком дорогого запуска, это усилит позиции ИИ не в демонстрациях, а в повседневной разработке и выпуске продукта.

Источник: Hacker News Репозиторий: GitHub