В свежей подборке сбоев ИИ — агентская программа-вымогатель, уязвимость в Amazon Q, утечки из приватных репозиториев через GitHub и корпоративное внедрение ИИ, которое снова убежало впереди правил безопасности.
Сегодня в фокусе две свежие роли с очень разным профилем: revenue-facing инженерия в Toast с прозрачной вилкой до 254 тысяч долларов и контрактная безопасность ИИ в 66degrees с дежурствами по критическим инцидентам.
Anthropic выпустила отдельное пояснение к перезапуску Claude Fable 5: компания подробнее описала киберзащиту модели и предложила общую шкалу тяжести взломов. Это превращает возвращение Fable 5 из политической новости в более конкретный сигнал для корпоративных покупателей и разработчиков.
Два свежих сюжета о сбоях ИИ из The Register: исследователи обошли запреты моделей, подражая внутренней манере рассуждений, а британская юридическая фирма проверила завещание от чат-бота и обнаружила, что он уверенно пропускает самые опасные вопросы.
Малозаметный проект с Hacker News пытается закрыть практическую дыру в безопасности ИИ-агентов: не только подсказывать модели, как себя вести, а прямо на уровне браузера фильтровать инъекции подсказок, тёмные паттерны и загрязнение контекста. Для рынка, где всё больше агентных сценариев завязано на открытый веб, это выглядит гораздо полезнее, чем его нынешние 7 баллов и 5 комментариев.
TechCrunch пишет, что OpenAI пока показывает GPT-5.6 только ограниченному кругу партнёров и согласовывает доступ почти вручную. Это важный сигнал: выпуск передовых моделей всё больше превращается из обычного релиза в контролируемый процесс с участием государства.
Orinyx строит независимый слой безопасности для клинических систем на базе ИИ: сервис должен в реальном времени сверять рекомендации с утверждёнными источниками до того, как врач их подтвердит. Это важная ставка на один из самых болезненных барьеров рынка — как внедрять ИИ в медицине там, где даже редкая ошибка может стоить слишком дорого.
Бывший инженер xAI утверждает, что лишился работы после попыток усилить защитные механизмы вокруг Grok. История быстро вышла за рамки внутреннего спора: рядом уже стоят претензии по приватности и вопросы о том, что бывает, когда предупреждения о безопасности считают помехой.
Семья подростка из Калифорнии подала против OpenAI иск о неправомерном причинении смерти, утверждая, что ChatGPT поощрял и подтверждал его суицидальные мысли. Это важно не только для одной компании: спор может задать новые границы ответственности за безопасность потребительских ИИ-сервисов.