Новые модели
AI Minute Newsroom
2026-08-22
Модель на восемь миллиардов параметров, которая и читает картинки, и рисует их в 4K, под лицензией Apache — сообщество запустило её за два дня
19 августа SenseTime выложила веса SenseNova-U1.5-8B-MoT на Hugging Face под лицензией Apache-2.0, в тот же день добавила дообученный вариант, а 20 августа — набор LoRA. Это не конвейер из частей, а единая нативная мультимодальная модель: те же восемь миллиардов параметров, которые смотрят на изображение, его же и создают и редактируют; лаборатория называет этот подход NEO-unify. В примечаниях к выпуску заявлены шесть конкретных улучшений по сравнению с прошлой версией: композиция и передача материалов, читаемость китайского и английского текста на плакатах и инфографике, более эффективная нативная генерация в 4K, редактирование, не портящее нетронутые части картинки, лучшее следование инструкциям, где нагромождены количества объектов и пространственные отношения, и более тонкое управление через рамки и референсные изображения. Проще проверить то, что случилось дальше. Примерно за сорок восемь часов сообщество выпустило конверсии GGUF и FP8, экспорт в ONNX и пакет для ComfyUI, так что модель пошла на обычных настольных сборках. У основного репозитория около 950 загрузок и 91 отметка; референсный код на GitHub, веса продублированы на ModelScope. Честное ограничение: сравнительные измерения SenseTime опубликовала в виде графиков, а не таблиц, независимой проверки пока не было, поэтому утверждения о местах в рейтинге стоит читать как слова самой лаборатории.
Почему это важноИнтересна здесь не турнирная таблица, а конструкция. Большинство доступных для скачивания графических инструментов — это одна модель, которая рисует, и другая, которая смотрит; тут один набор весов делает и то и другое, он достаточно мал для машины, которая у вас уже есть, и лицензия позволяет продавать сделанное. Нативное 4K важно по столь же будничной причине: это разница между картинкой, которую можно пустить на плакат, и картинкой, которую придётся растягивать. А два дня между тем, как китайская лаборатория выкладывает веса, и тем, как кто-то запускает их в ComfyUI, — теперь обычная скорость этой экосистемы: релиз перестал быть объявлением и стал загрузкой, которая на той же неделе оказывается на машинах у незнакомых людей.
✓ Проверено · 4 источников
▶ Видео по теме: New #1 Open Source Image AI? | SenseNova-U1 Mac & Windows Guide & TESTS
Читайте в приложении — бесплатно, 9 языков
Похожие новости
Открытые модели Google скачали миллиард раз, а сторонние разработчики собрали из них 100 000 версий
2026-08-22Дешёвая рабочая лошадка DeepSeek научилась видеть — и на агентных задачах, где нужны глаза, заявляет о приближении к лучшему у Anthropic
2026-08-21Покажите роботу один раз — от трёх до двенадцати секунд — и он выполнит работу верно 59 раз из 100 вовсе без обучения
2026-08-21Полгода назад Голливуд направил ByteDance требование прекратить нарушения. На этой неделе стороны подписали перемирие — и ни один доллар не перешёл из рук в руки.
2026-08-20Модель сама придумывает себе задачи, сама собирает стенд для их проверки и потом на результате обучается — а DeepReinforce ещё и раздала веса
2026-08-20