Новые модели
2026-08-05
Shieldstral от Mistral: открытая модель на 3 млрд параметров, которая модерирует по вашим правилам
Mistral выпустила Shieldstral 1.0 — открытый классификатор безопасности (Apache 2.0) на 3 млрд параметров, который оценивает текст и изображения по политике модерации, написанной обычным языком и передаваемой прямо при инференсе, и возвращает откалиброванные вероятностные оценки вместо фиксированных категорий. По словам Mistral, модель не уступает открытым guard-моделям до семи раз крупнее и работает на одной GPU с 16 ГБ памяти.
Почему это важноКаждому приложению с пользовательским контентом нужен фильтр, и большинство либо арендует его у крупного провайдера, либо прикручивает жёсткие списки категорий. Маленький, бесплатный и адаптируемый к политикам модератор удешевляет нормальную работу над безопасностью — и позволяет каждой платформе определить 'безопасное' своими словами.
✓ Проверено · 3 источников
Читайте в приложении — бесплатно, 9 языков
Похожие новости
Дешёвая рабочая лошадка DeepSeek научилась видеть — и на агентных задачах, где нужны глаза, заявляет о приближении к лучшему у Anthropic
2026-08-21Покажите роботу один раз — от трёх до двенадцати секунд — и он выполнит работу верно 59 раз из 100 вовсе без обучения
2026-08-21Модель сама придумывает себе задачи, сама собирает стенд для их проверки и потом на результате обучается — а DeepReinforce ещё и раздала веса
2026-08-20Бесплатная модель, помещающаяся на одну видеокарту, набирает 52 — и тратит 22 276 токенов размышления, чтобы нарисовать картинку
2026-08-18Zhipu не строила новую модель. Она продолжила обучать старую — и утверждает, что программирование стало лучше на 50 процентов
2026-08-17