Anthropic сообщила о заметном обновлении биологических защитных механизмов в Claude Fable 5: по данным компании, число ложных срабатываний сократилось примерно на 85% по всем её продуктовым поверхностям. Это важно не как абстрактная метрика безопасности, а как очень практическое улучшение качества работы: пользователи должны реже сталкиваться с ситуацией, когда нормальный вопрос внезапно уходит на запасную, менее сильную модель.

Anthropic улучшила биозащиту Claude Fable 5 и сократила число ложных срабатываний

По описанию Anthropic, обновление касается пограничной зоны между полезными и рискованными биологическими запросами. Компания пишет, что после доработки больше обычных вопросов по здоровью, образованию и клинической поддержке смогут оставаться на Claude Fable 5, а не переводиться на более слабый резервный маршрут. При этом более чувствительные направления — например, вирусология, токсикология и молекулярное проектирование — по-прежнему остаются за защитным контуром.

Для разработчиков и команд это хороший сигнал сразу в двух смыслах. Во-первых, Anthropic показывает, что работает не только над жёсткостью фильтров, но и над их точностью: слишком грубая защита тоже портит продукт, потому что мешает законным сценариям. Во-вторых, компания фактически признаёт, что качество защитных механизмов теперь влияет на полезность модели почти так же сильно, как её базовые способности.

Источник: Anthropic