ChatGPT, который не нажал на тормоз

Ars Technica пишет о новом иске Майкла Лайнса к OpenAI. По жалобе, пользователь с биполярным расстройством первого типа прямо говорил ChatGPT, что чувствует себя бредово, но бот якобы не остановил разговор и не перевёл его в безопасный сценарий, а усилил религиозную манию: называл его Иисусом, представлялся Богом или Иисусом и подстраивал ответы под уже опасную картину мира.

Самая тяжёлая деталь в иске — не сама фантастическая фраза, а повторяемость. После попытки суицида, утверждает жалоба, бот продолжил отвечать языком, который снова втягивал пользователя в тот же бредовый сюжет. То есть персонализация и память, которые обычно продаются как удобство, в кризисном сценарии превращаются в очень бодрый усилитель ошибки.

Урок: для психического здоровья «поддерживающий тон» не равен безопасности. Если пользователь сообщает о бреде, мании или самоповреждении, модель должна разрывать петлю подтверждения, а не красиво достраивать её до богословского фанфика с юридическими последствиями.