Kastra делает ставку не на ещё одного помощника для кода, а на слой контроля поверх уже популярных агентов. Идея простая: каждый запуск команды, правка файла и внешний вызов должны проходить через заранее заданные правила, чтобы автономность не превращалась в лишний риск.
В сегодняшней подборке сбоев — два сюжета из Ars Technica: в одном исследователи показали, как галлюцинации кодовых агентов превращаются в конвейер для вредоносных зависимостей, в другом спор об авторском праве вокруг OpenAI рискует превратиться ещё и в неприятную историю про журналы работы и сокрытие следов.
SuperHQ — ранняя открытая платформа для запуска ИИ-агентов для программирования в изолированных микровиртуальных машинах вместо прямого доступа к рабочему компьютеру. Проект обещает безопаснее работать с Claude Code и Codex, сохранять ключи вне песочницы и показывать изменения файлов через просмотр различий.
Четыре свежих AI-проекта с очень скромной видимостью: защита агентных систем на уровне кода, корпоративная платформа для совместной работы агентов, вертикальные агенты для жилья и гостиниц и рынок агентов для инвестиционных команд.
В сегодняшней подборке AI-фейлов — два очень поучительных сюжета. В одном Cisco ускорила подготовку инцидентных отчётов, но заодно получила смешение данных и выдуманные правки. В другом автономному агенту дали карточку и реальные задачи — и он устроил маленький фестиваль утечек, спама и CAPTCHA-страданий.
TencentCloud вывела в открытый доступ CubeSandbox — сервис песочниц для AI-агентов, который делает ставку на аппаратную изоляцию, быстрый запуск и совместимость с E2B. Это не потребительский инструмент, а инфраструктурный слой для команд, которым нужно безопасно исполнять код, сгенерированный моделью, и при этом не провалиться в слишком тяжёлую виртуализацию.
Сразу несколько свежих историй показывают, что проблемы ИИ всё чаще выглядят не как забавные сбои, а как вполне прикладные риски: от опасных действий в среде разработки до обхода защит и маскировки машинного текста в академических работах.
Две свежие истории показывают, как AI ломает не только интерфейсы, но и базовые социальные правила: в одном случае Grok фигурирует в тяжёлом иске о создании преступных изображений ребёнка, в другом преподаватель Brown увидел резкий обвал результатов после возврата экзамена в аудиторию.
Сегодняшняя подборка — про свежие проекты, у которых пока почти нет внимания, но есть внятная идея: от координации ИИ-агентов и безопасной работы с секретами до маршрутизации между моделями и попытки перенести логику базовых моделей в робототехнику. Почти у всех здесь слабый внешний сигнал — единичные голоса, ноль звёзд или просто тихий запуск без продвижения, — но именно поэтому на них стоит смотреть раньше толпы.