OpenAI фактически признала неприятную вещь: ещё не выпущенная модель Astra может оказаться настолько сильной в киберсценариях, что для неё заранее готовят более жёсткие ограничения. Как пишет The Register, компания обещает изолированные испытания, урезанный доступ к сети и инструментам, усиленный мониторинг и работу в песочнице.

OpenAI обещает усилить защиту Astra после тревожных испытаний

По сути, индустрия снова демонстрирует один и тот же шаблон: сначала показывают всё более мощные системы, а потом уже по ходу дела выясняют, какие ограждения нужно срочно достраивать, чтобы демонстрация не превратилась в уголовную хронику. Неловкость момента усиливает то, что Anthropic, по данным статьи, одновременно смягчает часть отказов на биологические запросы, чтобы не отстать в конкурентной гонке.

Главный вывод здесь скучный, но важный: если защитные меры появляются только после того, как внутренние тесты начинают напоминать компьютерные преступления, значит безопасность по-прежнему идёт в хвосте у маркетинга и выпуска новых возможностей. Источник: The Register.