Mistral AI выпускает Shieldstral — классификатор безопасности с открытыми весами
Mistral AI
Mistral AI выпустила Shieldstral — классификатор безопасности контента с открытыми весами на 3 миллиарда параметров для текста и изображений, лицензированный под Apache 2.0. Он принимает политики безопасности на естественном языке во время инференса вместо дообучения, работает на одном GPU с 16 ГБ и возвращает калиброванные вероятностные оценки вместо бинарных меток.
Почему это важно
Даёт разработчикам лёгкую, адаптируемую под политики модель модерации для self-hosting, конкурирующую с проприетарными guardrail API крупных лабораторий.
Важность: 3/5
Заметная новая продуктовая линейка с открытыми весами от фронтир-лаборатории, а не патч-обновление.
Источники
официальный
Introducing Shieldstral