Mistral выпустила Shieldstral: 3B-модель для модерации контента, работающая без переобучения
Shieldstral — 3B open-weights классификатор безопасности, который принимает политику модерации в виде plain-language вопроса прямо на инференсе. Модель обрабатывает текст и изображения, не требует переобучения под новые категории, работает на одной 16GB NVIDIA GPU. Релиз под Apache 2.0.