aiminute. ← Все новости ИИ
Новые модели AI Minute Newsroom 2026-08-22

Модель на восемь миллиардов параметров, которая и читает картинки, и рисует их в 4K, под лицензией Apache — сообщество запустило её за два дня

Модель на восемь миллиардов параметров, которая и читает картинки, и рисует их в 4K, под лицензией Apache — сообщество запустило её за два дня

19 августа SenseTime выложила веса SenseNova-U1.5-8B-MoT на Hugging Face под лицензией Apache-2.0, в тот же день добавила дообученный вариант, а 20 августа — набор LoRA. Это не конвейер из частей, а единая нативная мультимодальная модель: те же восемь миллиардов параметров, которые смотрят на изображение, его же и создают и редактируют; лаборатория называет этот подход NEO-unify. В примечаниях к выпуску заявлены шесть конкретных улучшений по сравнению с прошлой версией: композиция и передача материалов, читаемость китайского и английского текста на плакатах и инфографике, более эффективная нативная генерация в 4K, редактирование, не портящее нетронутые части картинки, лучшее следование инструкциям, где нагромождены количества объектов и пространственные отношения, и более тонкое управление через рамки и референсные изображения. Проще проверить то, что случилось дальше. Примерно за сорок восемь часов сообщество выпустило конверсии GGUF и FP8, экспорт в ONNX и пакет для ComfyUI, так что модель пошла на обычных настольных сборках. У основного репозитория около 950 загрузок и 91 отметка; референсный код на GitHub, веса продублированы на ModelScope. Честное ограничение: сравнительные измерения SenseTime опубликовала в виде графиков, а не таблиц, независимой проверки пока не было, поэтому утверждения о местах в рейтинге стоит читать как слова самой лаборатории.

Почему это важноИнтересна здесь не турнирная таблица, а конструкция. Большинство доступных для скачивания графических инструментов — это одна модель, которая рисует, и другая, которая смотрит; тут один набор весов делает и то и другое, он достаточно мал для машины, которая у вас уже есть, и лицензия позволяет продавать сделанное. Нативное 4K важно по столь же будничной причине: это разница между картинкой, которую можно пустить на плакат, и картинкой, которую придётся растягивать. А два дня между тем, как китайская лаборатория выкладывает веса, и тем, как кто-то запускает их в ComfyUI, — теперь обычная скорость этой экосистемы: релиз перестал быть объявлением и стал загрузкой, которая на той же неделе оказывается на машинах у незнакомых людей.
#Генерация изображений

✓ Проверено · 4 источников

▶ Видео по теме: New #1 Open Source Image AI? | SenseNova-U1 Mac & Windows Guide & TESTS
WhatsApp X Telegram
Читайте в приложении — бесплатно, 9 языков

Похожие новости

Видеомодель размечает съёмку с точки зрения самого робота.
2026-10-07
Новая поисковая модель Google занимает 191 мегабайт на телефоне.
2026-10-07
Mistral бесплатно отдаст свою модель на триллион параметров.
2026-10-06
Reflection бесплатно отдаст модель на 501 миллиард параметров.
2026-10-06
ChatGPT подписывает поддельные карикатуры именами реальных авторов.
2026-10-06