Источник: TechCrunch

TechCrunch сообщает, что Anthropic предложила дать внешним оценщикам безопасности, включая METR и Redwood Research, более глубокий доступ внутрь компаний, которые делают передовые ИИ-модели. OpenAI тоже выразила поддержку такой идеи.

Главный вопрос — независимость. Сами оценщики говорят, что для настоящей проверки могут понадобиться закон или более жёсткие условия доступа: иначе внешняя оценка рискует остаться контролируемой самими лабораториями.

Практический смысл для разработчиков и пользователей ИИ простой: проверка моделей постепенно уходит от финального отчёта перед выпуском к постоянному наблюдению за процессом. Если подход закрепится, серьёзным лабораториям придётся показывать не только итоговую модель, но и промежуточные версии, журналы поведения, документацию обучения и решения по рискам.

Для компаний, которые встраивают такие модели в продукты, это тоже важно. Поставщик с понятной внешней проверкой, журналами и правилами допуска будет выглядеть надёжнее, чем лаборатория, которая просит верить ей на слово.