Mistral открыла Shieldstral: 3 млрд параметров против контента
Mistral выпустила Shieldstral 1.0 — открытый модератор контента на 3 млрд параметров, работающий на GPU 16 ГБ и превосходящий конкурентов в 7 раз крупнее по точности. Политику задаёшь текстом — переобучения не нужно.
Компания Mistral выпустила Shieldstral 1.0 — открытую модель для проверки контента весом 3 млрд параметров. При запуске на обычной видеокарте с 16 ГБ памяти она превосходит конкурентов в 7 раз крупнее по точности фильтрации текста и изображений — как на стандартных бенчмарках, так и на специализированных задачах отклонения опасного контента. Веса доступны по лицензии Apache 2.0 на Hugging Face.
Политика как текстовый запрос — без переобучения
Ключевое отличие Shieldstral от предыдущих решений: правила модерации не вшиты в веса модели, а задаются в виде обычного текста прямо в запросе. Один чекпоинт умеет проверять и текст, и изображения без переобучения под каждый новый контекст. Это принципиально меняет подход: раньше смена политики означала новый цикл дообучения и недели инженерной работы.
Теперь профессиональный уровень контент-фильтрации перестал быть привилегией облачных гигантов. Любой разработчик, у которого есть сервер с GPU 16 ГБ, получает инструмент, который прежде требовал крупных вычислительных бюджетов. Открытые веса по Apache 2.0 означают, что Shieldstral можно встроить в продукт без зависимости от внешнего API.
Источник: mistral.ai
Бесплатный курс
Хватит читать про ИИ — начни строить с ним
Бесплатный курс Claude Code: свой первый сайт, инструмент или игра — без программирования. Без апсейлов и кросс-сейлов — здесь нечего купить.
Начать →
Автор
Евгений Арсентьев
PhD · CEO, digital health
Статьи · Свежие статьи