Крупнейшие лаборатории ИИ всё ещё не объяснили, как будут отключать опасную модель

Исследование Guidelight, о котором пишет TechCrunch, посмотрело на публичные материалы OpenAI, Anthropic, Google, Meta и xAI и пришло к неприятному выводу: у большинства игроков до сих пор нет внятно описанного публичного плана, что делать, если модель выходит из-под контроля или получает слишком широкие права. Речь не о красивых принципах, а о приземлённых вещах: кто и как ограничивает доступы, как быстро можно остановить вычисления и можно ли вообще полностью снять систему с линии.

Практический вывод для тех, кто внедряет ИИ в продукты и внутренние процессы, довольно жёсткий. Если поставщик не показывает, как именно он будет локализовывать серьёзный инцидент, вам приходится самим закладывать дополнительные проверки, ограничения и сценарии аварийного отключения. Иначе в критический момент окажется, что у вас есть мощная модель, но нет прозрачного ответа на вопрос, кто нажмёт на стоп и что после этого реально остановится.

Источник: TechCrunch