Mistral открыла Shieldstral — компактный фильтр безопасности для текста и изображений

Mistral 4 августа представила Shieldstral — мультимодальный классификатор безопасности на 3 млрд параметров с открытыми весами под лицензией Apache 2.0. Модель умеет проверять и текст, и изображения, а правила безопасности можно задавать обычным языком прямо во время работы, не пришивая их навсегда к одной фиксированной схеме.

Почему это важно:

  • Команды получают не просто ещё один «запретитель», а более гибкий слой контроля, который можно подстраивать под собственные внутренние политики без отдельного переобучения.
  • Небольшой размер означает более низкий порог внедрения: такую модель проще запускать локально и встраивать в прикладные продукты, где важны задержка, стоимость и контроль над данными.
  • Это ещё один сигнал, что конкуренция между AI-компаниями идёт уже не только вокруг самых сильных универсальных моделей, но и вокруг инфраструктурных компонентов — проверки безопасности, маршрутизации и рабочих инструментов для разработчиков.

Источник: официальный анонс Mistral