Nuevos Modelos
AI Minute Newsroom
2026-08-22
Un modelo de ocho mil millones de parámetros que lee imágenes y las dibuja en 4K, con licencia Apache, y la comunidad lo tenía funcionando en dos días
SenseTime publicó los pesos de SenseNova-U1.5-8B-MoT en Hugging Face el 19 de agosto bajo licencia Apache-2.0, seguidos ese mismo día por una variante ajustada y por un conjunto de LoRAs el 20 de agosto. No es una tubería de piezas sino un único modelo multimodal nativo: los mismos ocho mil millones de parámetros que miran una imagen también la generan y la editan, un enfoque que el laboratorio llama NEO-unify. Las notas de la versión reclaman seis mejoras concretas frente a la anterior: mejor composición y representación de materiales, texto chino e inglés más legible en carteles e infografías, generación nativa en 4K más eficiente, ediciones que dejan intacto lo que no se tocó, mayor fidelidad a instrucciones que acumulan recuentos de objetos y relaciones espaciales, y control más fino mediante cajas delimitadoras e imágenes de referencia. Más fácil de comprobar es lo que vino después. En unas cuarenta y ocho horas la comunidad publicó conversiones GGUF y FP8, una exportación ONNX y un paquete para ComfyUI, de modo que el modelo corre en equipos de escritorio corrientes. El repositorio principal va por unas 950 descargas y 91 me gusta; el código de referencia está en GitHub y los pesos también en ModelScope. Un límite honesto: SenseTime publicó sus comparativas como gráficos y no como tablas, y todavía no hay evaluación independiente, así que conviene leer las afirmaciones de ranking como propias del laboratorio.
Por qué importaLo interesante no es el marcador, es la forma. La mayoría de las herramientas de imagen que uno puede descargar son un modelo que dibuja y otro que mira; aquí un mismo conjunto de pesos hace las dos cosas, es lo bastante pequeño para correr en la máquina que ya se tiene y viene con una licencia que permite vender lo que se haga con él. El 4K nativo importa por una razón igual de poco glamurosa: marca la diferencia entre una imagen que sirve para un cartel y otra que hay que ampliar. Y los dos días que separan a un laboratorio chino publicando pesos de alguien ejecutándolos en ComfyUI ya son la velocidad normal de este ecosistema: un lanzamiento ha dejado de ser un anuncio para ser una descarga que aterriza esa misma semana en máquinas ajenas.
✓ Verificado · 4 fuentes
▶ Vídeo relacionado: New #1 Open Source Image AI? | SenseNova-U1 Mac & Windows Guide & TESTS
Léelo en la app — gratis, en 9 idiomas
Noticias relacionadas
Un modelo etiqueta el vídeo grabado desde la vista del robot.
2026-10-07El nuevo modelo de búsqueda de Google cabe en 191 megabytes.
2026-10-07Mistral regalará este mes su modelo de un billón de parámetros.
2026-10-06Reflection regalará un modelo de 501.000 millones de parámetros.
2026-10-06ChatGPT firma sus viñetas falsas con el nombre de dibujantes reales.
2026-10-06