Шесть тихих запусков, за которыми почти никто не следит: от проверки инженеров в эпоху AI до памяти для разработческих сессий, защиты от внедрения подсказок и сборки документации из видео.
yolo-cage — открытый инструмент для запуска автономных помощников по программированию в изолированной среде с фильтрацией сетевого трафика и ограничениями на операции с GitHub. Проект пытается решить практическую проблему: как дать агенту больше свободы, не позволяя ему утянуть секреты или самостоятельно слить изменения.
Сегодняшняя подборка про более медленные, но важные сдвиги вокруг AI: кто на самом деле управляет созданием передовых систем, почему деньги становятся таким же фактором траектории, как качество моделей, и что свежие исследования говорят о навыках для агентов и правилах их развёртывания. Здесь меньше громких релизов и больше сигналов о том, как меняется сама структура отрасли.
В свежей подборке сбоев ИИ — агентская программа-вымогатель, уязвимость в Amazon Q, утечки из приватных репозиториев через GitHub и корпоративное внедрение ИИ, которое снова убежало впереди правил безопасности.
Сегодня в фокусе две свежие роли с очень разным профилем: revenue-facing инженерия в Toast с прозрачной вилкой до 254 тысяч долларов и контрактная безопасность ИИ в 66degrees с дежурствами по критическим инцидентам.
Anthropic выпустила отдельное пояснение к перезапуску Claude Fable 5: компания подробнее описала киберзащиту модели и предложила общую шкалу тяжести взломов. Это превращает возвращение Fable 5 из политической новости в более конкретный сигнал для корпоративных покупателей и разработчиков.
Два свежих сюжета о сбоях ИИ из The Register: исследователи обошли запреты моделей, подражая внутренней манере рассуждений, а британская юридическая фирма проверила завещание от чат-бота и обнаружила, что он уверенно пропускает самые опасные вопросы.
Малозаметный проект с Hacker News пытается закрыть практическую дыру в безопасности ИИ-агентов: не только подсказывать модели, как себя вести, а прямо на уровне браузера фильтровать инъекции подсказок, тёмные паттерны и загрязнение контекста. Для рынка, где всё больше агентных сценариев завязано на открытый веб, это выглядит гораздо полезнее, чем его нынешние 7 баллов и 5 комментариев.
TechCrunch пишет, что OpenAI пока показывает GPT-5.6 только ограниченному кругу партнёров и согласовывает доступ почти вручную. Это важный сигнал: выпуск передовых моделей всё больше превращается из обычного релиза в контролируемый процесс с участием государства.