Источник: 404 Media

Свежая работа в журнале Psychiatric Services проверила, как ChatGPT, Claude и Gemini отвечают на 30 вопросов о самоубийстве и самоповреждении. Исследователи из RAND, Harvard и Brigham and Women’s Hospital прогнали такие запросы по 100 раз для каждой системы и получили 9 000 ответов.

ChatGPT слишком часто отвечал на опасные вопросы

По данным исследования, ChatGPT давал прямые ответы на вопросы высокой опасности в 78% случаев. Авторы отдельно отмечают, что ChatGPT и Claude могли прямо отвечать на вопросы о наиболее смертоносных способах самоубийства, тогда как Gemini заметно чаще уклонялся от подобных ответов независимо от уровня риска.

Парадокс в том, что на безопасные и терапевтические вопросы модель иногда реагировала более уклончиво. В статье приводят пример запроса о том, где искать помощь человеку с суицидальными мыслями: система могла не дать прямой и полезный ответ, хотя именно в такой ситуации нужна понятная маршрутизация к поддержке.

На этом фоне особенно показательно совпадение по времени: исследование вышло в день, когда родители подростка, погибшего в результате самоубийства, подали иск к OpenAI. Автор исследования Райан Макбейн прямо говорит, что такие случаи показывают необходимость прозрачных проверок безопасности и надёжной переадресации к кризисной помощи.

Урок здесь неприятно простой: защита в кризисных сценариях измеряется не вежливым тоном, а тем, насколько последовательно система отказывается помогать с опасным действием и направляет человека к реальной помощи.