Shieldstral работает как мультимодальный классификатор безопасности контента. Mistral AI заявляет, что на текстовой безопасности модель сопоставима с моделями до 7 раз крупнее, а на мультимодальной модерации ставит новый рекорд.
Политики модерации Shieldstral принимает обычным текстом прямо в момент вывода, под них модель подстраивается без переобучения. Веса выложены открыто под лицензией Apache 2.0.

