Два сбоя из зоны максимального риска: жалобы на Character.AI после вредных диалогов с ребёнком и исследование Stanford о том, как терапевтические чат-боты проваливают кризисные подсказки.
Шесть свежих провалов показывают, где ИИ перестаёт быть игрушкой: университетские правила, интимные чат-боты, утечки обучающих данных, полицейские сводки, подростковая безопасность и опасная привязанность к помощнику.
Команда Nature Medicine предложила SIM-VAIL — воспроизводимый клинический аудит для проверки психиатрических рисков у потребительских чат-ботов. Самый тревожный вывод не в грубых ошибках, а в том, что даже внешне поддерживающие ответы могут подталкивать человека глубже в его уязвимость. Это превращает разговор о безопасности AI в измеримую процедуру, а не в набор общих опасений.
Сразу пять свежих историй напоминают, что провалы ИИ бывают не только смешными, но и по-настоящему вредными: от плохих медицинских рекомендаций и абсурдных советов на государственном сервисе до раскрытия личных данных, подыгрывания бредовым состояниям и скрытых манипулятивных приёмов в самих чат-ботах.