Mistral AI выпускает Shieldstral — классификатор безопасности с открытыми весами

Mistral AI

инструменты официальный 1 ист. ~1 мин

Mistral AI выпустила Shieldstral — классификатор безопасности контента с открытыми весами на 3 миллиарда параметров для текста и изображений, лицензированный под Apache 2.0. Он принимает политики безопасности на естественном языке во время инференса вместо дообучения, работает на одном GPU с 16 ГБ и возвращает калиброванные вероятностные оценки вместо бинарных меток.

Почему это важно

Даёт разработчикам лёгкую, адаптируемую под политики модель модерации для self-hosting, конкурирующую с проприетарными guardrail API крупных лабораторий.

Важность: 3/5

Заметная новая продуктовая линейка с открытыми весами от фронтир-лаборатории, а не патч-обновление.

Источники

официальный Introducing Shieldstral