Nuevos Modelos
AI Minute Newsroom
2026-08-22
Un modelo de ocho mil millones de parámetros que lee imágenes y las dibuja en 4K, con licencia Apache, y la comunidad lo tenía funcionando en dos días
SenseTime publicó los pesos de SenseNova-U1.5-8B-MoT en Hugging Face el 19 de agosto bajo licencia Apache-2.0, seguidos ese mismo día por una variante ajustada y por un conjunto de LoRAs el 20 de agosto. No es una tubería de piezas sino un único modelo multimodal nativo: los mismos ocho mil millones de parámetros que miran una imagen también la generan y la editan, un enfoque que el laboratorio llama NEO-unify. Las notas de la versión reclaman seis mejoras concretas frente a la anterior: mejor composición y representación de materiales, texto chino e inglés más legible en carteles e infografías, generación nativa en 4K más eficiente, ediciones que dejan intacto lo que no se tocó, mayor fidelidad a instrucciones que acumulan recuentos de objetos y relaciones espaciales, y control más fino mediante cajas delimitadoras e imágenes de referencia. Más fácil de comprobar es lo que vino después. En unas cuarenta y ocho horas la comunidad publicó conversiones GGUF y FP8, una exportación ONNX y un paquete para ComfyUI, de modo que el modelo corre en equipos de escritorio corrientes. El repositorio principal va por unas 950 descargas y 91 me gusta; el código de referencia está en GitHub y los pesos también en ModelScope. Un límite honesto: SenseTime publicó sus comparativas como gráficos y no como tablas, y todavía no hay evaluación independiente, así que conviene leer las afirmaciones de ranking como propias del laboratorio.
Por qué importaLo interesante no es el marcador, es la forma. La mayoría de las herramientas de imagen que uno puede descargar son un modelo que dibuja y otro que mira; aquí un mismo conjunto de pesos hace las dos cosas, es lo bastante pequeño para correr en la máquina que ya se tiene y viene con una licencia que permite vender lo que se haga con él. El 4K nativo importa por una razón igual de poco glamurosa: marca la diferencia entre una imagen que sirve para un cartel y otra que hay que ampliar. Y los dos días que separan a un laboratorio chino publicando pesos de alguien ejecutándolos en ComfyUI ya son la velocidad normal de este ecosistema: un lanzamiento ha dejado de ser un anuncio para ser una descarga que aterriza esa misma semana en máquinas ajenas.
✓ Verificado · 4 fuentes
▶ Vídeo relacionado: New #1 Open Source Image AI? | SenseNova-U1 Mac & Windows Guide & TESTS
Léelo en la app — gratis, en 9 idiomas
Noticias relacionadas
Los modelos abiertos de Google se han descargado mil millones de veces, y desde fuera han construido 100.000 versiones
2026-08-22El caballo de batalla barato de DeepSeek ya ve — y en tareas de agente que exigen ojos dice acercarse a lo mejor de Anthropic
2026-08-21Enséñaselo al robot una vez — de tres a doce segundos — y acierta 59 veces de cada 100 sin ningún entrenamiento
2026-08-21Hace seis meses Hollywood mandó a ByteDance un requerimiento legal. Esta semana firmaron una tregua, y no cambió de manos ni un dólar.
2026-08-20El modelo se inventa sus propias tareas, monta el banco de pruebas para medirlas y luego se entrena con el resultado; y DeepReinforce ha regalado los pesos
2026-08-20