Mistral выпустила Shieldstral — открытую модель модерации для запуска на устройстве

Mistral выпустила Shieldstral — модель с открытыми весами на 3 млрд параметров, которая проверяет тексты и картинки на запрещённое содержимое. Обычно такую фильтрацию делают запросом к чужому сервису, то есть пользовательские данные уходят наружу.
Shieldstral рассчитан на запуск рядом с приложением или прямо на устройстве: оценка выдаётся за один прогон модели, поддерживаются 12 языков и контекст на 32 тыс. токенов. На вход принимаются и текст, и изображения. Проект vLLM, через который модели обслуживают запросы, добавил поддержку в день релиза.
Mistral AI@MistralAI
🛡️Introducing Shieldstral, Mistral’s 3B open-weights model for content safety that can be deployed on-device 🧵 https://t.co/SXBTWIJO9p https://t.co/Hhjw8o0gft
2 110 ♡
4 августа 2026Что говорят
fastballHacker News
Надо было назвать Safestral. И мне нравится новая стратегия Mistral — упор на небольшие узкоспециализированные модели, видимо, потому что их большие MoE не тянут конкуренцию с фронтиром.
mosuraHacker News
Кто-нибудь применит это ровно наоборот: отфильтрует «оскорбительный» контент и соберёт его в рассылку для людей с вкусом. Mistral хотя бы понимает, чего сейчас хочет их рынок, но через пару лет такой рынок ничего не будет стоить. Ещё это можно встроить в пайплайн, чтобы генерить контент, который подходит к грани, но не срабатывает фильтр.
petcatHacker News
Mistral пора бросить брендинг «всё-straal». «Shieldstral» — неуклюжее и плохое имя.