Mistral AI представила Shieldstral — открытую модель безопасности с 3 млрд параметров, ... — 5 августа 2026 г. в 22:58:01.922
Mistral AI представила Shieldstral — открытую модель безопасности с 3 млрд параметров, предназначенную для модерации текста и изображений. Нейронка не привязана к фиксированному набору категорий: правила модерации задаются прямо в запросе пользователя. Модель распространяется по лицензии Apache 2.0, поддерживает 12 языков и запускается на одной видеокарте с 16 ГБ VRAM. В основе Shieldstral лежит Ministral-3-3B, а для обработки изображений используется Pixtral. Контекст достигает 32 тыс. токенов, а обучение проводилось на 54,1 млн примеров, включая 45,2 млн текстовых, 4,4 млн синтетических контрастных и 4,5 млн мультимодальных образцов. По данным Mistral, модель показывает 84,9% F1 в задачах текстовой модерации, 83,8% F1 при проверке мультимодального контента и 91,3% F1 в тесте на адаптацию к новым политикам безопасности. Компания заявляет, что по качеству Shieldstral сопоставима с открытыми моделями, которые примерно в семь раз крупнее, хотя эти результаты пока основаны на внутренних тестах разработчика. Shieldstral стала первой открытой моделью безопасности в линейке Mistral. Ранее компания предлагала только облачные API для модерации с фиксированными категориями, тогда как теперь пользователи могут самостоятельно развернуть модель и адаптировать правила проверки под собственные задачи.

