Две свежие новости показывают, как быстро спор о безопасности передовых моделей уходит от общих деклараций к устройству контроля: кто проверяет, кто сообщает об инцидентах и где проходит красная линия для самых мощных систем.
OpenAI, Anthropic и Google хотят создать общий орган для проверок моделей
По данным The Verge со ссылкой на The Information, OpenAI, Anthropic и Google обсуждают запуск организации для стандартов безопасности передовых моделей. Она может появиться в начале 2027 года и заниматься практиками независимого тестирования моделей, а также правилами сообщения об инцидентах.
Практический эффект для команд, которые строят или внедряют ИИ, простой: рынок может получить не только государственные нормы, но и частную инфраструктуру проверок. Это способ быстрее унифицировать аудит, но одновременно источник вопросов о независимости: если крупнейшие лаборатории сами проектируют правила, регуляторам и клиентам придется внимательнее смотреть, кто именно оценивает риск.
В США предложили запретить искусственный сверхинтеллект с уголовными наказаниями
The Verge пишет, что сенатор Берни Сандерс и конгрессмен Грег Касар внесли законопроект о запрете разработки искусственного сверхинтеллекта. В нем предлагается приостановить часть работ над продвинутым ИИ до появления научно управляемого федерального ведомства по ИИ, а за нарушение предусмотреть наказание вплоть до двадцати лет тюрьмы.
Даже если такой проект не пройдет в нынешнем виде, он важен как политический маркер. В США появляется язык не только про добровольные обещания безопасности, но и про разрешения, пределы разработки и персональную ответственность. Для лабораторий это сигнал готовить доказуемые процедуры оценки риска; для пользователей и корпоративных заказчиков — спрашивать поставщиков не только о возможностях модели, но и о том, кто и как проверял ее опасные сценарии.
Комментарии (5)
Войдите или зарегистрируйтесь, чтобы оставить комментарий.
Я запуталась в слове «независимая проверка»: если правила делают сами большие лаборатории, то кто потом проверяет проверяющих? Для обычного пользователя разница между честным аудитом и красивым значком «безопасно» вообще как-то будет видна?
Именно поэтому знак проверки сам по себе мало что даёт. Пользователю и регулятору нужны опубликованные критерии, следы разногласий и понятный механизм, по которому внешний проверяющий может сказать лаборатории «нет».
Да, без права сказать «нет» это похоже на школьную проверку тетради соседом по парте. Мне как обычному читателю важнее не значок, а понятное место, где видно: вот критерий, вот спор, вот что лаборатория обязана исправить.
Хорошо, что разговор о проверках становится конкретнее, но меня холодит от мысли, что правила безопасности будут проектировать те же игроки, которым нужно быстрее выпускать новые модели. Это как если бы тормозную комиссию собирали из людей, соревнующихся за самый быстрый спуск.
Саморегулирование здесь выглядит полезным только при одном условии: правила проверки и сообщения об инцидентах должны быть достаточно конкретными, чтобы потом их можно было предъявить самой лаборатории. Иначе получится красивый клуб с печатью «безопасно», а в споре после сбоя все снова будут искать, кто именно обязан был заметить риск.